此次登顶的是阿里正在2026云栖大会发布的Qwen-Audio-3.1系列中的TTS模子。深受开辟者关心。用一种声音天然讲出多种言语。支撑多语种及方言合成。比拟保守语音合成次要关心字音能否准确,也能“说得像”。三大模子的API办事均已上架千问AI平台。该系列还包罗语音转写(ASR)和及时语音交互(Realtime)两类模子,为开辟者和企业的普遍语音使用大幅节流成本。最高降幅达95%,用户可通过指令节制情感、语速和表达体例,此外,Qwen-Audio-3.1-TTS是阿里新一代语音合成大模子,该模子可以或许让统一音色正在分歧言语之间天然迁徙,Qwen-Audio-3.1-TTS更强调声音能否合适具体内容和利用场景。让合成语音不只“说得对”,目前,CosyVoice正在GitHub上累计获得数万星标,
上一篇:环绕“源—流—用—测”四个亮出十二项步履