動察 Beating AI 速報、フランスのAI企業Mistralが新しいフラッグシップモデル「Mistral Large 4」を発表、内部での愛称は「Le Chonk」。MoEアーキテクチャを採用し、総パラメータ数は1.05兆に達するが、推論ごとに活性化されるのは490億パラメータのみ。モデルはネイティブで画像・テキスト入力に対応し、コンテキスト長は最大100万トークン。APIはすでにプレビューを開放しており、モデルの重みは10月27日に公開予定。
Mistralによると、Large 4は現在アメリカとヨーロッパで開発された中で総合性能が最も強いオープンウェイトモデル。公式が示したDeepSWE v1.1ソフトウェアエンジニアリング評価では62%、その比較表ではGLM-5.3が61%、DeepSeek V4 Proが57%、Qwen 3.8 Maxが51%。金融評価のFinchでは67%を獲得し、DeepSeek V4 Proと並ぶ。衛星画像の目標位置特定DIOR-RSVGでは73%を獲得し、GPT-6 Astraの68%を上回った。
ただし、これらの成績は現在主にMistralの自社テストによるもので、統一された基準ではない。智譜がGLM-5.3を発表した際、同じDeepSWE v1.1で公表した成績は66.9%、Kimi K3は67.5%に達し、いずれもLarge 4の62%を上回っている。異なるチームが使用するテスト設定や実行方法は異なる可能性がある。
Large 4はゼロから訓練され、Mistralは約4000基のNvidia Grace Blackwell GPUを使用し、ヨーロッパ自社のデータセンターで約2か月間訓練した。Mistralは「ヨーロッパの自主性」もセールスポイントとしており、モデルは訓練、APIサービスから将来の自主展開まで、すべてヨーロッパのインフラ上に留めることが可能だ。