阿里巴巴的 Qwen 推出 Qwen-Audio-3.0-TTS,提供 300ms 闪释版本以实现实时交互

BABA4.73%
阿里巴巴的 Qwen 发布了 Qwen-Audio-3.0-TTS,这是一种语音合成模型,支持自由式自然语言指令。该模型包含用于实时交互的 Flash 版本,首包延迟为 300ms;以及用于高质量生成的 Plus 版本。
免责声明:本页面信息可能来自第三方,仅供参考,不代表 Gate 的观点或意见,亦不构成任何财务、投资或法律建议。数字资产交易风险较高,请勿仅依赖本页面信息作出决策。具体内容详见声明
评论
0/400
暂无评论