Qwen发布新一代文本转语音模型Qwen-Audio-3.0-TTS,登顶榜单
Qwen推出Qwen-Audio-3.0-TTS,提供Flash(实时)和Plus(高质量)两个版本,支持16种语言、细粒度标签控制(如笑声、低语)及自然语言风格指令,最长3分钟一次性生成。目前在Artificial Analysis TTS Leaderboard排名第一。博客:https://t.co/ACqTI2wGHI[1]
今日AI动态聚焦Qwen-Audio-3.0-TTS模型发布,登顶榜单;ChatGPT Sites功能上线,支持一键部署网站;FLUX 3视频生成模型获社区热评,细节真实度极高。