快讯
阿里通义千问推出语音合成大模型 Qwen-Audio-3.0-TTS
阿里正式推出语音合成大模型Qwen-Audio-3.0-TTS,包含面向实时交互的Flash版本和面向高质量生成的Plus版本。模型在细粒度标签控制、自然语言指令风格定义、多语种与方言覆盖及复杂声学鲁棒性等方面实现系统性提升,支持在文本中嵌入结构化标签精准调控语气与情绪,覆盖16种语言和20种方言。
阿里正式推出语音合成大模型Qwen-Audio-3.0-TTS,包含面向实时交互的Flash版本和面向高质量生成的Plus版本。模型在细粒度标签控制、自然语言指令风格定义、多语种与方言覆盖及复杂声学鲁棒性等方面实现系统性提升,支持在文本中嵌入结构化标签精准调控语气与情绪,覆盖16种语言和20种方言。