千问重磅推出Qwen-Audio-3.0-TTS语音合成大模型
2026-07-20 17:06:50未知 作者:徽声在线
在7月20日这一天,科技界迎来了一项重要进展——千问团队正式对外发布了其最新研发的语音合成大模型Qwen-Audio-3.0-TTS。这款大模型不仅具备强大的语音合成能力,还创新性地支持了Free-style自然语言指令控制,使得用户可以通过简单的自然语言指令来精确控制语音的生成效果。此外,为了满足不同场景下的需求,Qwen-Audio-3.0-TTS还特别推出了两个版本:一是面向实时交互场景的Flash版本,其首包延时控制在300ms级别,确保了语音交互的流畅性和即时性;二是面向高质量生成场景的Plus版本,致力于提供更为细腻、逼真的语音合成效果。


