2026-07-20 14:00发布推测时间
阿里千问发布Qwen-Audio-3.0-TTS语音合成大模型
该语音合成大模型包含实时交互Flash版本(首包延时300ms级别)和高质量生成Plus版本,在细粒度标签控制、freestyle指令遵循、16种语言+20种方言覆盖、复杂声学鲁棒性等方面显著提升,实现合成语音从“能说话”到“会表达”的升级。
来自 星盘大模型百科
xingpanai.com
该语音合成大模型包含实时交互Flash版本(首包延时300ms级别)和高质量生成Plus版本,在细粒度标签控制、freestyle指令遵循、16种语言+20种方言覆盖、复杂声学鲁棒性等方面显著提升,实现合成语音从“能说话”到“会表达”的升级。
来自 星盘大模型百科