動察Beatingのモニタリングによると、OpenAIはフロンティアモデルのトレーニングを積極的に減速し始めている。同社は一時、一部のフロンティアRLトレーニングを2週間停止し、最大規模のいくつかは今も再開されていない。Astraの多くのトレーニングと評価もまだ停止中だ。
Hugging Faceへの侵入はその理由の一つに過ぎない。OpenAIは同時に、Astraのネットワーク攻撃能力が社内で定義された「Critical」の閾値に達している可能性を発見した。このような高リスクなトレーニングは、まず隔離、監視、アライメントをより高い基準に引き上げてからでないと継続できない。
オルトマンは以前、モデルの能力が安全対策よりも速く進化するなら、AI開発は減速すべきだと述べていた。Hugging Face事件後、彼はこれが初めてフロンティアモデルの安全リスクを実感させたとも語った。その後、1200人以上のトップAI企業の従業員が連名で、業界全体に統一された減速メカニズムの構築を求め、その中には複数のOpenAIの中核研究者も含まれている。
今、OpenAI自身が先にブレーキを踏んだ。