发生了什么
Artificial Analysis 发布 Speech to Speech Index
为什么值得关注
该基准提供了主流语音转语音模型的性能、速度和成本对比,有助于选择适合场景的模型。
信息来源
以下内容来自公开来源,可打开原文继续核验。
Artificial Analysis 发布语音转语音模型基准
Artificial Analysis 发布 Speech to Speech Index,综合 Big Bench Audio、Full Duplex Bench 和 τ-Voice 三个数据集评估原生语音转语音模型质量。GPT-Realtime-2 (High) 以 77.2% 领先,Grok Voice Think Fast 1.0 以 75.7% 紧随其后,GPT-Realtime-1.5 和 Gemini 3.1 Flash Live Preview (High) 分别为 72.0% 和 69.5%。速度方面 Deepslate Opal 最快(TTFA 0.44s),成本方面 Gemini 3.1 Flash Live Preview (Minimal) 最低($1.50)。
打开原始来源 ↗