← AI 情报

通千问推出 Qwen-Audio-3.0-TTS:支持 16 种语言,可控制语调和笑声,登顶 TTS 排行榜

产品发布来源: x作者: Alibaba_Qwen热度: 1238发布于 2026年7月23日

阿里发布最新语音合成模型 Qwen-Audio-3.0-TTS,有 Flash(实时)和 Plus(高质量)两种版本。新增细粒度标签控制(如[耳语]、[愤怒]、[呼吸]、[笑声])和自然语言指令(如“像睡前故事一样慢慢读”),支持 16 种语言和最多 3 分钟长文本生成,在 Artificial Analysis TTS 排行榜上位列第一。

  • Qwen
  • TTS
  • audio
  • leaderboard
  • Speech Synthesis
查看原文 →

评论

登录后即可评论

还没有评论,来发第一条吧。