BlockBeats 報道、6月21日、GPU販売業者Tinygradが発表したところによると、信頼できる情報筋から、GLM 5.2モデルが2台のネットワーク接続されたBlackwellアーキテクチャのtinybox上で、毎秒120トークンの推論速度を実現できるとのことです。
この構成の価格は15万ドルで、標準のtinybox2台またはtinybox Pro1台を選択可能で、いずれも上記の性能を達成できます。Tinygradはこれを売りに、「一度購入すれば、クラウド費用は永久に不要」というプライベートデプロイメント路線を打ち出し、従量課金制のクラウド推論サービスと直接競合しています。
現在、この情報はまだGLM公式によって確認されておらず、Tinygradも技術的な詳細を明らかにしていません。
---------------------------------
下記の原文リンクをクリックして、動察 Beating · 飛書 AI ニュースチャンネルに参加し、24時間365日、世界のAIホットトピックとニュースをモニタリングしましょう。