動察 Beatingのモニタリングによると、Grok 4.6はすでに自身の推論システムの最適化に参加し始めています。SpaceXAIはモデルカードで、初期バージョンのGrok 4.6にGrok Chatの高速化を自律的に行わせたことを開示しました。モデルは自ら方案を試すことができますが、コードを提出する前に、システム全体が実際に高速化されたことを証明する必要があります。
5時間の間に、Grok 4.6は一気に297の最適化方案を試し、MoE、注意力計算、基盤オペレーターのスケジューリング、通信に関わりました。また、小規模テストでのみ高速化され、完全なシステムでは効果が得られなかった一連の方案を淘汰しました。最終的にモデルは7つのPRを提出し、そのうち3つはすでにGrok Chatの本番環境に組み込まれています。これらのコードにより、生成段階のスループットは1.5%向上し、入力処理段階は3.1%向上しました。
SpaceXAIの目標は推論システムの最適化だけにとどまりません。モデルカードには、Grokに自身の新バージョンのトレーニングと評価の一部の研究開発作業を自動的に担わせるテストを行っていると明記されています。タスクには、トレーニング中の報酬ハッキングの発見、トレーニングデータの生成と審査、大規模トレーニングシステムのトラブルシューティング、新機能の評価設計がすでに含まれています。
これはすでにAIの自己改善に該当しますが、再帰的な自己進化にはまだ達していません。