通义实验室 公众号·· 2026-07-20精选AI 评分73
通义实验室发布 Qwen-Audio-3.0-TTS 语音合成模型
从“能说话”到“会表达”:Qwen-Audio-3.0-TTS 发布
AI 导读
通义实验室正式发布实时语音合成模型 Qwen-Audio-3.0-TTS,推出首包延迟约 300ms 的 Flash 版与注重音色还原度的 Plus 版。模型覆盖 16 种语言及 20 种中文方言,支持自然语言指令控制与呼吸、笑场等结构化标签嵌入调控,单次合成支持最长 3 分钟并升级至 48kHz 音频输出,现已在阿里云百炼平台上线。
推荐理由
模型提供兼顾实时与高音质的两个版本并支持指令控制情感,有助于开发者评估其在多语种及复杂场景的落地表现。
来源:通义实验室 公众号 · mp.weixin.qq.com