AI风向标
通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型
通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约300ms)和 Plus 两个版本。Plus 版本在 Artificial Analysis 榜单夺冠,支持16种语言和20种中文方言,平均 WER/CER 低至3.87(Flash),说话人相似度最高达82.75(Plus)。
详细介绍
通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约300ms)和 Plus 两个版本。Plus 版本在 Artificial Analysis 榜单夺冠,支持16种语言和20种中文方言,平均 WER/CER 低至3.87(Flash),说话人相似度最高达82.75(Plus)。
AI HOT 详情:https://aihot.virxact.com/items/cmrt0856a09v9bitl62e4r17b
原文链接:https://mp.weixin.qq.com/s/INvrqTrWLMm2WCLIqhqTrg
内容信息
- 分类
- 模型发布/更新
- 时间
- 2026-07-20T08:53:11.000Z
