IT之家 7 月 20 日消息,阿里千问今日发布语音合成大模型 Qwen-Audio-3.0-TTS,包含面向实时交互的 Flash 版本(首包延时 300ms 级别)和面向高质量生成的 Plus 版本。