← 返回精选动态
精选动态

Artificial Analysis 发布语音转语音模型基准

Artificial Analysis 发布 Speech to Speech Index

更新于 2026年06月23日 23:49 1 条公开来源

发生了什么

Artificial Analysis 发布 Speech to Speech Index

为什么值得关注

该基准提供了主流语音转语音模型的性能、速度和成本对比,有助于选择适合场景的模型。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

Artificial Analysis 发布语音转语音模型基准

twitter关注列表 2026年06月23日 23:03

Artificial Analysis 发布 Speech to Speech Index,综合 Big Bench Audio、Full Duplex Bench 和 τ-Voice 三个数据集评估原生语音转语音模型质量。GPT-Realtime-2 (High) 以 77.2% 领先,Grok Voice Think Fast 1.0 以 75.7% 紧随其后,GPT-Realtime-1.5 和 Gemini 3.1 Flash Live Preview (High) 分别为 72.0% 和 69.5%。速度方面 Deepslate Opal 最快(TTFA 0.44s),成本方面 Gemini 3.1 Flash Live Preview (Minimal) 最低($1.50)。

打开原始来源 ↗
← 返回精选动态