動察 Beating AI 速報、智譜が GLM-5.3-FlashX をリリース。GLM-5.3-Flash の高速版と理解でき、最高出力速度は 200 tokens/s に達する。公式は今回、新たな能力ベンチマークやアーキテクチャの変更を公表しておらず、更新の重点は推論速度のさらなる向上にある。
今回のリリースは、昨日の推論システム最適化の直後に位置づけられる。智譜は先ほど、GLM-5.3 が駆動する Infra Agent が Flash の推論インフラの最適化に参加したと明らかにした。2 週間足らずで、エンドツーエンドのスループットは当初の約 3 倍に向上し、サービス全体は 10 万枚を超える国産 AI チップ上で稼働している。