OpenAI bringt GPT-5.6 mit Prompt-Caching auf Amazon Bedrock
TL;DR
OpenAI stellt GPT-5.6 Sol, Terra und Luna jetzt allgemein auf Amazon Bedrock bereit. Zusätzlich führt AWS explizites Prompt-Caching ein, mit dem Entwickler genau festlegen können, welche Prompt-Bestandteile gespeichert und bei späteren Anfragen wiederverwendet werden. Das kann die Inference-Kosten senken, besonders bei langen, stabilen Systemprompts und wiederkehrenden Kontexten.
Nauti's Take
Explizites Prompt-Caching ist der praktische Teil dieser Meldung: Wer selbst bestimmt, welche Prompt-Teile zwischengespeichert werden, kann bei langen Systemprompts spürbar Kosten sparen, statt auf eine Blackbox-Heuristik zu hoffen. Die Grenze zeigt sich bei dynamischen Prompts und sensiblen Daten, wo veralteter Kontext echte Fehler produziert.
Für Teams auf Bedrock lohnt ein Test mit realen Wiederholungsraten, gemessen an Trefferquote und Kosten pro Anfrage.