🤖 AI

GPT-6は「前に読んだ長い説明」を再利用 AIエージェントを速く安くする新キャッシュ

約3分で読めます Tiny Why編集部 · 文: 特派員 キュリオ

ことば
プロンプトキャッシュ(ぷろんぷときゃっしゅ)

同じ入力の一部を再利用し、毎回の処理を減らす仕組み。

キャッシュヒット率(きゃっしゅひっとりつ)

送った入力のうち、保存した部分を再利用できた割合。

AIエージェント(えーあいえーじぇんと)

複数の作業を続けて進めるAI。

何が起きたか

OpenAIは2026年9月22日、GPT-6向けのプロンプトキャッシュを改善したと発表した。公式発表 GPT-6を使う長時間のAIエージェントは、ひとつの仕事で何度もAPIへ問い合わせる。毎回の入力には、同じ指示、使える道具の定義、前のやり取りの一部が含まれることがある。新しい仕組みは、この共通する前半部分を再利用しやすくする。条件を満たす共有部分は、30分の間に使い回せる。キャッシュされた入力トークンは、最大90%の割引対象になる。

背景:AIは同じ説明を何度も受け取る

長い仕事をするAIは、質問に一度答えて終わるとは限らない。コードを直したり、資料を調べたり、文書を作ったりする間に、何度も次の作業へ進む。そのたびに、仕事のルールや道具の説明を送り直すと、同じ文字列の処理が重なる。

プロンプトキャッシュは、モデルが内容を永久に覚える機能ではない。短い時間に同じ前半が再び送られたとき、その計算をやり直さずに再利用する仕組みだ。説明の後ろだけが変わる仕事では、前半を保ったまま新しい指示を足せる。

なぜ重要か

AIエージェントが長く働くほど、入力の重複は速度と費用に影響する。キャッシュが使えれば、返事を始めるまでの時間を短くし、毎回の入力処理にかかる費用も抑えやすい。開発者にとっては、長い仕事を何度も動かす設計が現実的になる。

重要なのは、今回の発表が「もっとキャッシュを使う」と言うだけで終わっていない点だ。どこで再利用できなかったかを調べ、必要な部分だけを保存するための道具もまとめて出した。

確認できたこと

新しいダッシュボードでは、入力のどれだけがキャッシュから出たかを時系列で確認できる。診断ツールは、モデル、道具、設定、入力のどこが変わって再利用できなかったのかを、直近の応答と比べて示す。影響を受けたトークン数も見られる。

開発者は、再利用したい前半の終わりを明示するキャッシュの区切りを置ける。GPT-6では、途中で推論の深さを変えても、リクエスト全体の設定を変えずに行えば、前のキャッシュを保ちやすい。道具の定義や順番を安定させ、新しい指示を後ろに足す方法も案内されている。最初の質問が来る前に、共通の説明を準備しておく機能もある。

OpenAIは利用例として、GitHub Copilotで新しく処理するプロンプトの割合が以前の基準より50%以上減ったと説明した。別の導入例では、キャッシュヒット率が85%前後から90%超へ上がった例や、83%から91%へ上がり、推論費用が36%下がった例も紹介されている。

まだ分からないこと

これらの数字は、OpenAIや導入企業が紹介した結果であり、すべての会社で同じ効果が出ると確認されたわけではない。仕事の長さ、指示の安定性、道具の変更頻度によって、結果は変わる。

また、最大90%の割引はキャッシュされた入力トークンに限られる。新しく変わった部分や、再利用できなかった入力まで同じ割合で安くなるわけではない。30分の条件もあり、キャッシュは長期記憶とは違う。

次に見る点

今後は、開発者が自分のアプリでキャッシュヒット率、返事の速さ、実際の請求額をどう測るかが焦点になる。公式ガイド(https://developers.openai.com/api/docs/guides/prompt-caching)に沿って設定を変えたとき、数字だけでなく、AIエージェントの仕事全体が安定するかも確かめる必要がある。今回の改善は、AIを賢くするというより、長い仕事で同じ処理を繰り返さないための基盤を整える動きだ。

🤖 AI

GPT-6、同じ説明を使って速く答える

📰 しっかり版: GPT-6は「前に読んだ長い説明」を再利用 AIエージェントを速く安くする新キャッシュ

長い仕事で何度も使う説明を再利用し、返事の速さと費用を改善します。

約1分で読めます Tiny Why編集部 · 文: 特派員 キュリオ

ことば
プロンプトキャッシュ(ぷろんぷときゃっしゅ)

AIに送った説明の一部を、もう一度使う仕組み。

キャッシュミス(きゃっしゅみす)

保存した説明を使えなかったこと。

キャッシュの区切り(きゃっしゅのくぎり)

どこまでの説明を再利用するか決める場所。

💡 ようするに

  • OpenAI(GPT-6を提供する会社)は、AIが同じ説明を使える仕組みを改善しました。
  • 再利用できると、返事が速くなり、入力の料金も下がります。
  • 失敗の理由を見る画面や、使う場所を決める機能も増えました。

AIに送る文は、質問だけではありません。仕事のルールや道具の説明も入ります。長い仕事では、同じ説明を何度も送ることがあります。

GPT-6のプロンプトキャッシュは、その説明の共通部分を一時的に使い回します。30分以内に同じ前半を使うと、毎回すべてを処理せずにすみます。キャッシュされた入力トークンは、最大90%安くなることがあります。これは入力部分の割引です。仕事全体の料金が、いつも90%下がるわけではありません。

この仕組みは、AIが何でも覚える機能ではありません。説明の内容や道具が変わると、再利用できないことがあります。これをキャッシュミスと呼びます。

OpenAIは、どれくらい再利用できたかを見る画面を用意しました。ミスが起きたときは、モデルや道具、設定、入力のどれが変わったかを調べられます。開発者は、残したい説明の終わりをキャッシュの区切りとして指定できます。

OpenAIの発表では、導入した会社で再利用の割合が上がり、費用が下がった例も紹介されています。ただし、これは一部の利用例です。使うアプリの作り方によって、結果は変わります。

次に大切なのは、実際のアプリで速さと料金を測ることです。GPT-6の改善は、AIの知能を直接高めるものではありません。同じ仕事を何度もするときの無駄を減らす改善です。

OpenAIの発表では、詳しい使い方も案内されています。

🤖 AI

GPT-6は前のメモをもう一度使える

📰 しっかり版: GPT-6は「前に読んだ長い説明」を再利用 AIエージェントを速く安くする新キャッシュ

同じ説明を何度も読む仕事で、GPT-6が少し速く働けるようになりました。

約1分で読めます Tiny Why編集部 · 文: 特派員 キュリオ

ことば
GPT-6(ジーピーティーシックス)

文章を読んで答えるコンピューター。

プロンプト(ぷろんぷと)

AIに送るお願い文。

キャッシュ(きゃっしゅ)

前の説明を置いておくメモのような場所。

OpenAI(GPT-6を作る会社)は、新しい助けを作りました。発表

GPT-6(お話を読んで答えるコンピューター)には、長い説明を送ります。 その説明をプロンプト(AIへのお願い文)と呼びます。

同じ説明を何度も送る仕事があります。 GPT-6は、前に読んだ説明を置いておけます。 キャッシュは、近くに置くメモのようなものです。

次も同じ説明なら、そのメモを使えます。 だから、はじめから全部を読み直さずにすみます。 返事が速くなることがあります。 読ませる部分のお金が、最大90%安くなることもあります。

同じメモは、30分のあいだ使えることがあります。 ずっと覚えているわけではありません。 説明が変わると、メモを使えないことがあります。

OpenAIは、メモを使えたか見る画面も作りました。 使えなかった理由も調べられます。

GPT-6は、長い仕事で同じことをする回数を減らせます。

出典・参考