找回密码
 立即注册
搜索
热搜: 活动 交友 discuz
查看: 60|回复: 0

目前顶级的 AI 配音 / 声音克隆模型

[复制链接]
发表于 2026-9-18 17:14:05 | 显示全部楼层 |阅读模式
目前顶级的 AI 配音 / 声音克隆模型,建议先把这 5 个存下来。

1️⃣ MiniMax Speech / Audio
中文是真的强,音色克隆、长文本 TTS 都能打,做小说、有声书、短视频口播很合适。
🔗 https://minimax.io/audio

2️⃣ Qwen3-TTS
阿里通义的开源方案,多语言、声音克隆都支持,重点是能自己部署。
🔗 https://github.com/QwenLM/Qwen3-TTS

3️⃣ ElevenLabs
目前 AI 配音第一梯队,自然度、情绪、语气都很顶,做剧情旁白和有声书尤其舒服。
🔗 https://elevenlabs.io

4️⃣ Fish Audio / Fish Speech
开源声音克隆里的热门选手,多语言、情感表达、流式生成都不错,本地部署党重点看。
🔗 https://github.com/fishaudio/fish-speech

5️⃣ Microsoft VibeVoice
微软开源的长音频模型,主打超长文本 + 多人对话,很适合播客、访谈这类场景。
🔗 https://github.com/microsoft/VibeVoice

中文优先 MiniMax / Qwen,追求真人感看 ElevenLabs,想白嫖本地部署就重点研究 Fish Speech / VibeVoice。

现在 AI 声音已经越来越难分真假了,克隆真人声音记得先取得授权。

回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|Archiver|手机版|小黑屋|腾飞在线 ( 冀ICP备05002530号 )

GMT+8, 2026-9-27 00:33 , Processed in 0.059116 second(s), 17 queries .

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表