動察 Beatingのモニタリングによると、Artificial AnalysisがついにQwen3.8-27Bの独立ベンチマークを補完しました:Intelligence Indexは52点です。
このわずか27BパラメータのDenseモデルは、DeepSeek V4 Flash 0731やGPT-5.6 Luna Maxに直接追いつき、DeepSeek V4 Pro 0813やGLM-5.2の53点とはわずか1点差です。前世代のQwen3.6-27Bはわずか38点でした。
さらに驚くべきはAgent能力です。Qwen3.8-27BのAgentic Indexは51点に達し、DeepSeek V4 Proの50点、DeepSeek V4 Flashの48点、GPT-5.6 Lunaの47点を上回っています。この指標は、モデルがツールを呼び出し、ステップを計画し、複雑なタスクを連続して完了する能力を専門にテストするものです。
ただし、52点には代償もあります。Artificial AnalysisがIntelligence Indexの全セットを実行した際、Qwen3.8-27Bは合計約1.6億の出力トークンを生成しており、明らかに「トークンで知能を積み上げる」タイプです。
Qwen公式のデフォルト推論レベルはまさにxhighであり、medium、low、思考オフもサポートしています。現在、Artificial Analysisは具体的にどの推論レベルを使用したかを明示しておらず、これがデフォルトのxhighの成績であるかどうかはまだ確認できません。