AI圈报
模型发布 / 更新精选

网易有道发布 Confucius4-TTS:14 语种跨语种无口音语音克隆开源模型

信息来源:IT之家(RSS)·
原始标题:网易发布 Confucius4-TTS:业内首个支持 14 种语言跨语种无口音、且无需参考文本即可完成语音克隆的开源模型,3 秒音频即可克隆音色

内容摘要

网易有道推出"子曰 4.0"TTS 引擎 Confucius4-TTS,声称是业内首个支持 14 种语言跨语种无口音、且无需参考文本即可完成语音克隆的开源模型。用户仅需 3 秒音频即可实现零样本音色克隆,克隆音色与原声相似度超 85%,任务准确度达 97%。模型支持中文、英语等 14 种语言,首创音频 Prompt 情感克隆迁移。底层采用 GPT 式语义大模型、SSL 预训练特征与 ECAPA-TDNN 说话人编码器、Flow Matching 框架。已全量开源(Apache 协议),提供 54GB 资源包供本地部署。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源IT之家(RSS)
站内情报编号intel-8f03a0346728e9cf2c571db0