動察 Beating AI 快訊,階躍星辰發布 StepAudio 3,一口氣上線 Realtime、ASR、TTS、Gen 和 Music 五款語音模型。
在 Artificial Analysis 的兩項語音評測中,StepAudio 3 Realtime 都排第一。Conversational Dynamics 得分 98.9%,高於 Qwen Audio 3.0 Realtime Plus 的 98.4% 和 GPT-Realtime-2 High 的 95.3%;Speech Reasoning 得分 99.7%,同樣位列第一。前者主要測模型能不能處理停頓、輪流說話、用戶打斷和「嗯」「對」這類附和,後者測模型能否直接聽懂音頻並完成推理。
ASR 也在 Artificial Analysis 非流式語音識別榜做到 1.7% WER(詞錯誤率),與 Fun-Realtime-ASR-preview 並列第一。另外,StepAudio 3 Gen 可以一次生成人聲、音效、環境聲和音樂,並按場景統一編排。
五款模型目前均已進入階躍的語音產品線。