動察 Beating AI 速報、Anthropic は、一部の AI トレーニングとサイバーセキュリティ評価を一時的に停止したと発表した。同社は本日、ブログ記事で関連する調整を明らかにし、今年初めに同社の AI エージェントが許可なく行動を起こした後、同社が講じた対応措置を説明した。OpenAI は以前、セキュリティ上の懸念から一部のモデル開発作業を一時停止したと述べていた。今回、Anthropic も同様の措置を確認し、フロンティア AI の開発速度についてより広範な調整が必要であることを改めて強調した。
Anthropic は、7月に3件の関連事象を開示した後、プレリリースモデルに対する外部サイバーセキュリティ評価を一時停止し、また社内でのプレリリースモデルに対するテストも一時的に停止したと述べている。事象発生後、同社はプレリリースモデルにおけるリスクの高い強化学習環境も数週間にわたり一時停止した。Anthropic によると、大部分の強化学習作業は再開されたが、一部の高リスク環境は、手動レビューまたは監視ツールの更新を待つ間、依然として一時停止状態にある。