動察Beatingのモニタリングによると、智譜AIの最新MoEフラッグシップモデル「GLM-5.2」が、Artificial Analysis大規模モデル知能指数v4.1評価で51点を獲得し、MiniMax-M3(44点)、DeepSeek V4 Pro(max、44点)、Kimi K2.6(43点)を上回り、世界のオープンソースモデルのトップに輝きました。
現実世界の知識業務をシミュレートしたGDPval-AA v2テストでは、GLM-5.2は1524点(人間の基準点は1000点)を獲得し、MiniMax-M3(1418点)やDeepSeek V4 Pro(max、1328点)をリードし、クローズドソースの最先端大規模モデルGPT-5.5(xhigh reasoning)と肩を並べました。前世代のGLM-5.1と比較して、科学推論CritPtは16ポイント上昇し21%に、HLEは12ポイント上昇し40%に、TerminalBench v2.1は16ポイント上昇し78%に、GPQA Diamondは89%に達しました。
GLM-5.2は「知能-タスクコスト」のパレートフロンティアにおいて、最適なコストパフォーマンスの位置を占めています。1タスクあたりの平均出力が43kトークン(GLM-5.1は26k)であるため、GLM-5.2の1タスクあたりの平均コストは約0.46ドルに上昇し、GLM-5.1(0.25ドル)やDeepSeek V4 Pro(max、0.05ドル)より高いものの、同じ知能レベルのクローズドソースモデルよりはるかに低い水準です。
GLM-5.2は総パラメータ744B、活性化パラメータ40B、コンテキストウィンドウは前世代の200Kから1Mに拡大され、MITライセンスのもとでオープンソース化されています。現在、智譜公式API(価格設定:入力1.4、出力4.4 / 百万トークンあたり)およびSiliconFlow、DeepInfra、Nebius AIなどのプラットフォームでサービスが提供されています。