動察 Beating AI 速報、Anthropic が Claude Opus 5.5 をリリース、これは Claude 5.5 シリーズの最初のモデルです。公式によると、ほとんどのタスクで Fable 5.1 の水準に達しつつ、典型的なワークロードのコストは Opus 5 より 40% 低く、出力速度は 30% 以上高速です。API 価格は入力 4 ドル、出力 20 ドル/百万 tokens に下がり、いずれも Opus 5 より 20% 安い;キャッシュ読み取りは 0.20 ドルに下がり、60% 安くなりました。
コーディング評価の向上が最も顕著です。Terminal-Bench 4.0 で、Opus 5.5 は 66.4% を記録し、GPT-6 Astra の 57.9% を上回りました;FrontierCode v1.1 では 54.4% 対 53.3% です。Anthropic によると、デフォルト effort で FrontierCode を実行した場合、Opus 5.5 が Astra の最高スコアを超えるとき、1 問あたりのコストは後者の約 5 分の 1 にすぎません;GDPval-AA v2.1 でも 1846 Elo で Fable 5.1 の 1735 と Astra の 1542 を上回りました。
ただし、全線でリードしているわけではありません。AutomationBench では GPT-6 Astra が 41.4%、Opus 5.5 が 40.0% です;Terminal-Bench-Science でも Astra のスコアがより高いです。
これは Anthropic が「フロンティアモデルの推進を減速する」と発表した後にリリースした最初のモデルです。同社によると、Opus 5.5 はその自動化行動監査で現在最高の成績を獲得しました。Pro、Max、Team の 5 時間枠も同時に引き上げられ、Sonnet 5.5 と Haiku 5.5 は今後数週間で登場する予定です。