動察 Beating AI 速報、OpenAI は現在、有料の高速モード「Ultra Fast」を提供しており、課金すればモデルの応答がより速くなります。有効にすると、GPT-5.6 Sol は最大で毎秒 750 トークンに達し、通常モードの約 14 倍の速度になります。Codex の責任者 Tibo Sottiaux 氏は、今後 1 〜 2 年で、現在のこの速度がデフォルトレベルに近づく可能性があると予測しています。
ただし、14 倍はモデル自体の最大出力速度に過ぎません。実際にコードを書く場合、生成に時間がかかるなら全体で約 10 倍速くなりますが、エージェントがウェブ検索やツール実行、ネットワーク応答待ちを行う場合、タスク全体では通常 3 〜 4 倍しか速くなりません。モデルの出力が速くなるにつれて、ボトルネックはモデルからネットワーク、CPU、ツール呼び出しへと移行します。
Ultra Fast は OpenAI 内部でも節約して使用する必要があります。重大な障害や重要なプロトタイプなどのタスクは優先的に使用できますが、大部分の計算リソースは外部顧客に残されており、そうしないと OpenAI の従業員だけで容量を消費してしまうからです。