7 月 21 日,阿里云正式发布语音合成大模型 Qwen-Audio-3.0-TTS。该模型在细粒度标签控制、freestyle 指令遵循、多语种与方言支持及复杂声学鲁棒性方面实现升级,提供面向实时交互的 Flash 版(首包延时约 300ms)和面向高质量生成的 Plus 版。Qwen-Audio-3.0-TTS-Plus 近日登顶全球第三方权威榜单 Artificial Analysis,其预览版 Fun-Realtime-TTS 此前已获该榜冠军。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。


登录后才可以发布评论哦
打开小程序可以发布评论哦