動察Beatingのモニタリングによると、OpenAIはGPT-5.6 Solが稼働開始後、自らをホストするプロダクションシステムの改善に参加し始めたことを明らかにした。Codexを通じて実際のトラフィックを分析し、リクエストの割り当てを調整し、GPUカーネル(チップの計算を制御する低レベルコード)を自律的に書き換えている。この最適化により、モデルのエンドツーエンドの実行コストが20%削減された。
GPT-5.6 Solはまた、付属のドラフトモデルを改善した。自ら数百回のアーキテクチャ実験を設計・実行し、トレーニングの開始と監視を行っている。ハードウェア障害やトレーニングの不安定性が発生した場合も、介入して対処する。その結果、投機的デコード(小規模モデルが先に予測し、メインモデルがバッチ検証する)によるトークン生成効率が15%以上向上した。
OpenAIはこのプロセスを継続的なフィードバックループとして説明している。すなわち、プロダクション環境を観察し、ボトルネックを特定し、システムを修正し、全体の効果を検証する。GPT-5.6はすでにこれらの複数の段階に参加している。