動察 Beating AI 速報、OpenAI が GPT-6 Astra に configuration_update を追加しました。Responses API の同じ長い会話内で、reasoning effort をいつでも引き上げたり引き下げたりでき、キャッシュ済みの Prompt プレフィックスを書き換える必要はありません。難しい問題には High、xhigh を選択し、簡単なタスクでは Low に戻しても、以前の長いコンテキストを引き続き再利用できます。
以前はこれは非常に隠れたコストの罠でした。reasoning effort はコンテキスト冒頭の指示として機能するため、途中で新しい思考レベルに切り替えると、大量のキャッシュを再利用できなくなります。Codex ユーザーの実測によると、切り替え後、キャッシュヒット率は 98.5% から 65% に低下し、次のラウンドでキャッシュを再構築して初めて 97% 以上に回復しました。
長時間実行される Agent にとって、この変更は非常に実用的です。難しい問題に直面した場合は一時的に思考強度を高め、簡単なタスクでは元に戻すことができ、単にギアを切り替えただけで、先ほどの数十万 Token のキャッシュが通常の入力として再処理されることはありません。