ceshi 发表于 2026-9-18 17:14:05

目前顶级的 AI 配音 / 声音克隆模型

目前顶级的 AI 配音 / 声音克隆模型,建议先把这 5 个存下来。

1️⃣ MiniMax Speech / Audio
中文是真的强,音色克隆、长文本 TTS 都能打,做小说、有声书、短视频口播很合适。
🔗 https://minimax.io/audio

2️⃣ Qwen3-TTS
阿里通义的开源方案,多语言、声音克隆都支持,重点是能自己部署。
🔗 https://github.com/QwenLM/Qwen3-TTS

3️⃣ ElevenLabs
目前 AI 配音第一梯队,自然度、情绪、语气都很顶,做剧情旁白和有声书尤其舒服。
🔗 https://elevenlabs.io

4️⃣ Fish Audio / Fish Speech
开源声音克隆里的热门选手,多语言、情感表达、流式生成都不错,本地部署党重点看。
🔗 https://github.com/fishaudio/fish-speech

5️⃣ Microsoft VibeVoice
微软开源的长音频模型,主打超长文本 + 多人对话,很适合播客、访谈这类场景。
🔗 https://github.com/microsoft/VibeVoice

中文优先 MiniMax / Qwen,追求真人感看 ElevenLabs,想白嫖本地部署就重点研究 Fish Speech / VibeVoice。

现在 AI 声音已经越来越难分真假了,克隆真人声音记得先取得授权。

页: [1]
查看完整版本: 目前顶级的 AI 配音 / 声音克隆模型