動察 Beating AI 速報、Googleは2つの新しいリアルタイム音声モデル Gemini 3.8 Live と Gemini 3.8 Live Extended Thinking を発表しました。Extended Thinking は複雑なタスクを専門に処理し、話しながら推論でき、バックグラウンドでツールを呼び出すこともでき、会話を止めて結果を待つ必要がありません。
Artificial Analysis の Speech-to-Speech Quality Index において、Gemini 3.8 Live Extended Thinking は82.6点を獲得し、GPT-Live-1 + Astra の81.5点と Grok Voice Think Fast 2.0 の81.3点を上回り、首位に立ちました。音声Agentタスク τ-Voice でも68.6%を記録しました。
通常版の Gemini 3.8 Live はより低コストのリアルタイムインタラクションに重点を置き、97言語の自動切り替え、リアルタイム視覚入力、非同期ツール呼び出しをサポートしています。両モデルはすでに Gemini API と Google AI Studio で利用可能で、音声入力の価格は1分あたり0.005ドル、出力は0.018ドルです。