動察 Beating AI 速報、Anthropic が GLM-5.3 のサイバーセキュリティ評価を公開した。本来の意図は、オープンウェイトモデルがサイバー攻撃の敷居を下げる可能性があると警告することだった。しかしテスト結果は同時に、GLM-5.3 に対する強力な第三者の裏付けにもなった。すでに複雑な脆弱性悪用を自律的に完了でき、一部の能力は Anthropic 自社の Claude Mythos Preview に近い。智譜の株価は本日ザラ場で一時2%超上昇した。
ExploitBench では、GLM-5.3 の410回の試行のうち50回がエンドツーエンドの脆弱性悪用を完了し、Claude Mythos Preview は56回だった。Claude Opus 4.6、GLM-5.2、Kimi K3、DeepSeek-V4.1-Flash は同じテストでいずれもほぼ0だった。Anthropic は、GLM-5.3 の脆弱性悪用能力は明らかな閾値を超えたと述べている。
研究者が GLM-5.3 にサンドボックス環境で主要ブラウザを検査させたところ、1日以内に複数のこれまで未知の脆弱性を発見し、さらに複数の 0-day を完全な攻撃チェーンに組み上げた。最終的に生成された悪意あるウェブページはブラウザサンドボックスを脱出でき、コンピュータ内の任意のファイルを直接読み取ることが可能で、SSH 秘密鍵も含まれる。
より小型の GLM-5.3-Flash でさえ、すでに公開されている Chrome の脆弱性を実用的な攻撃チェーンに仕立て上げられる。プロセス全体で必要な人手の介入は約20分だけで、モデル自体は8時間稼働した。智譜 API の価格で計算すると、コストはわずか20.40ドルだった。
Anthropic の GLM-5.3 に対する批判は主に安全制限に集中している。GLM-5.3 は直接的な悪意あるリクエストには本来拒否するが、偽の「レッドチームテスト」という背景に置き換えると64%のテストで実行を継続し、モデルの思考内容を事前に埋め込むと92%に上昇し、オープンウェイトを直接改変して拒否メカニズムを除去すると100%に達した。Anthropic は、オープンウェイトによって攻撃者がこれらの安全制限を直接取り外せると考えている。
このレポートは本来 GLM-5.3 がどれほど危険かを証明しようとしたが、その拡散効果はまるで競合他社が自ら性能広告を書いたかのようだった。米国 NIST も以前、独立して同様の結論を出しており、GLM-5.3 は現在サイバーセキュリティ能力が最も強いオープンウェイトモデルであるものの、総合能力では依然として米国のフロンティアモデルに約4か月遅れていると述べている。