OpenAI、GPT-6のキャッシュ性能を向上
効率と費用を改善
キャッシュ命中率の向上
最大90%の入力割引
30分間の接頭辞再利用
運用ツールを拡充
性能ダッシュボード
ミス原因の診断機能
明示的な区切り設定
応答前の事前準備
出典:OpenAI公式
詳細を読む
OpenAIは2026年9月22日、GPT-6向けの改良版プロンプトキャッシュを発表しました。複数のAPIリクエストで共通する指示やツール定義、文脈の計算結果を再利用し、長時間動くエージェントの応答を速め、入力コストを抑えます。対象となる共通の接頭辞は30分以内の再利用で割引され、キャッシュ済み入力トークンの割引率は最大90%です。
GPT-6ファミリーでは、標準設定のままでもキャッシュ命中率が高まります。新しいPrompt Caching Dashboardでは、命中率の推移やキャッシュ済み・未使用トークンの内訳を確認し、アプリ変更の影響を測定できます。
予想外のキャッシュミスには、診断ツールが直近の応答との違いを照合します。モデル、ツール、設定、入力のどこが再利用を妨げたかに加え、影響を受けた推定トークン数を示すため、開発者は改善箇所を判断できます。
新たな明示的キャッシュ区切りにより、再利用するプロンプトの接頭辞を選べます。またGPT-6では、リクエスト単位の推論強度を保ったまま設定更新を追加すると、キャッシュを壊さず応答間で推論強度を変えられます。
ツールや指示を変える際は、定義や並び順を維持し、利用可能なツールの指定や末尾への追加指示で再利用性を保てます。さらに事前ウォームアップで共通指示や資料を利用前に処理すれば、初回応答の待ち時間を短縮できます。