支持中英日韩等 14 种语言的无口音配音,仅需一段音频即可克隆音色与情绪

建议16GB以上内存。硬盘空间21GB以上。
macOS 15及以上版本,仅支持M系列芯片。
Windows10/11 64位,NVIDIA显卡,8GB以上显存。
注意:NVIDIA显卡,请安装较新版本的驱动。Confucius4-TTS 是由网易有道(NetEase Youdao)团队研发并开源的下一代多语言语音合成(TTS)与声音克隆引擎,隶属于网易有道“子曰”大模型 4.0 体系。该项目全面支持 中文、英语、日语、韩语、德语、法语、西班牙语、葡萄牙语、俄语、意大利语、越南语、泰语、印尼语、阿拉伯语 共 14 种语言的高质量合成与无口音跨语言克隆,旨在为个人创作者、开发者及企业提供低门槛的智能配音解决方案。
Confucius4-TTS 基于现代生成式 AI 架构打造,采用 Speech Encoder + LLM(语音编码器 + 大语言模型) 的自回归/非自回归混合生成路线,配合先进的语音声码器(Vocoder),实现了高保真度、低延迟的音频生成。