動察 Beating AI 速報、GLM-5.3 Flash リリース後、智譜はこれまで公開されていなかった詳細を確認した:Ox Alpha 匿名テスト期間中のトラフィックは、すべて中国国産 AI チップによって推論計算能力が提供されていた。
Ox Alpha は OpenRouter 上で完全な自然日 6 日間で 23.2 兆 Token を処理し、同期間の DeepSeek-V4-Flash の 2 倍以上だった。OpenCode は以前、バックエンドで毎日 100 兆 Token の無料枠を提供できるとさえ述べていた。
智譜は、同じ中国国産ハードウェア上でエンドツーエンドの推論性能を初期の 3 倍に最適化し、現在のハードウェア効率と単一 Token コストは主流の NVIDIA GPU に近づけることができたと述べている。
SemiAnalysis はこの点を特に取り上げた。これまで外部は毎日 100 兆 Token の供給能力を見て、この規模はトップクラスの研究所と NVIDIA GPU だけが支えられるのではないかと推測していた。しかし今回、最初から最後まで中国国産チップが使用されていた。