lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

ステップStepAudio 3がリリース:音声推論、リアルタイム対話の両ランキングで1位

動察 Beating AI 速報、階躍星辰が StepAudio 3 を発表し、Realtime、ASR、TTS、Gen、Music の5つの音声モデルを一挙に公開した。


Artificial Analysis の2つの音声評価で、StepAudio 3 Realtime はともに1位を獲得。Conversational Dynamics スコアは98.9%で、Qwen Audio 3.0 Realtime Plus の98.4%と GPT-Realtime-2 High の95.3%を上回った。Speech Reasoning スコアは99.7%で、こちらも1位。前者は主に、モデルが間(ま)や発話の交代、ユーザーの割り込み、「うん」「そう」といった相槌を処理できるかを測るもので、後者はモデルが音声を直接理解して推論を完了できるかを測るものだ。


ASR も Artificial Analysis の非ストリーミング音声認識ランキングで1.7% WER(単語誤り率)を達成し、Fun-Realtime-ASR-preview と並んで1位となった。また、StepAudio 3 Gen はボーカル、効果音、環境音、音楽を一度に生成でき、シーンに応じて統一的に編成できる。


5つのモデルは現在、すべて階躍の音声製品ラインに組み込まれている。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了