OpenAI、GPT-6のキャッシュ性能を向上

効率と費用を改善

キャッシュ命中率の向上
最大90%の入力割引
30分間の接頭辞再利用

運用ツールを拡充

性能ダッシュボード
ミス原因の診断機能
明示的な区切り設定
応答前の事前準備
詳細を読む

OpenAIは2026年9月22日、GPT-6向けの改良版プロンプトキャッシュを発表しました。複数のAPIリクエストで共通する指示やツール定義、文脈の計算結果を再利用し、長時間動くエージェントの応答を速め、入力コストを抑えます。対象となる共通の接頭辞は30分以内の再利用で割引され、キャッシュ済み入力トークンの割引率は最大90%です。

GPT-6ファミリーでは、標準設定のままでもキャッシュ命中率が高まります。新しいPrompt Caching Dashboardでは、命中率の推移やキャッシュ済み・未使用トークンの内訳を確認し、アプリ変更の影響を測定できます。

予想外のキャッシュミスには、診断ツールが直近の応答との違いを照合します。モデル、ツール、設定、入力のどこが再利用を妨げたかに加え、影響を受けた推定トークン数を示すため、開発者は改善箇所を判断できます。

新たな明示的キャッシュ区切りにより、再利用するプロンプトの接頭辞を選べます。またGPT-6では、リクエスト単位の推論強度を保ったまま設定更新を追加すると、キャッシュを壊さず応答間で推論強度を変えられます。

ツールや指示を変える際は、定義や並び順を維持し、利用可能なツールの指定や末尾への追加指示で再利用性を保てます。さらに事前ウォームアップで共通指示や資料を利用前に処理すれば、初回応答の待ち時間を短縮できます。