PolyBeatsのモニタリングによると、予測市場Polymarketにおいて、過去15分間で「claude-opus-4-6-thinkingは2026年6月13日までに最高のAIモデルになるか?」という質問の「ノー」確率が27.2%から52.2%に上昇し、買い側の総取引量は711ドルとなった。
Anthropicは6月9日にClaude Fable 5を発表し、本日LM Arenaランキングに登場したが、そのスコアはclaude-opus-4-6-thinkingを下回った。Wiredとウォール・ストリート・ジャーナルが6月11日に報じたところによると、Anthropicは当初、Claudeを使って競合モデルを訓練していると疑われるアカウントに対して「サイレントダウングレード」を計画していた。これはユーザーに通知せずにFable 5の性能を直接低下させるか、プロンプトの変更やモデルルーティングなどを通じて出力を弱めるというものだ。
開発者やAI研究コミュニティは、これが第三者による評価やオープンソース研究を密かに妨害することに相当し、特に外部のセキュリティ評価機関が自分たちがどの能力レベルのモデルをテストしているのか確認できなくなるとして批判した。
その後、Anthropicは公に謝罪し、戦略を調整して、このようなシナリオに対する秘密の性能ダウングレードを廃止し、より透明性の高いプロンプトや拒否メカニズムに変更した。システムがユーザーが高能力AIを構築しているか、競合モデルを訓練していることを検出した場合、リクエストを明確に拒否するか、ユーザーを低能力モデルにリダイレクトする。この変更により、Fable 5の公開評価の信頼性が向上し、コミュニティが実際の能力に近い形でランキングに参加していると信じやすくなり、現在市場でデフォルトでリードしていると見なされているclaude-opus-4-6-thinkingに直接挑戦する可能性がある。
---------------------------------
未来をより早く見るには、@PolyBeats_Botをフォロー
See tomorrow, today. Follow @PolyBeatsEN