@CIYYYT #1 模型 参数量 模型文件大小(按精度) 核心能力 IndexTTS 2.0 — Q8 · 3.63 GB<br>F16 · 4.65 GB<br>ORIG · 8.08 GB 中英音色克隆、情绪控制、参考演绎 IndexTTS 2.5 — Q8 · 3.50 GB<br>F16 · 4.55 GB<br>ORIG · 7.89 GB 多语言音色克隆、情绪控制、发音调整 VoxCPM2 2B Q8 · 2.96 GB<br>BF16 · 4.77 GB<br>ORIG · 4.96 GB 文字设计音色、音色克隆、参考原文辅助的精细克隆 OmniVoice 0.6B Q8 · 1.35 GB<br>BF16 · 1.64 GB<br>F16 · 1.64 GB 属性设计音色、音色克隆、非语言声音标签 Qwen3-TTS Base 0.6B Q8 · 1.99 GB<br>BF16 · 2.52 GB 参考音色克隆、可选原文辅助、多语言生成 Qwen3-TTS Base 1.7B Q8 · 2.70 GB<br>BF16 · 4.20 GB<br>ORIG · 4.54 GB 参考音色克隆、可选原文辅助、多语言生成 Qwen3-TTS CustomVoice 1.7B Q8 · 2.82 GB<br>BF16 · 4.18 GB 9 种内置音色、文字控制风格与情绪 Qwen3-TTS VoiceDesign 1.7B Q8 · 2.82 GB<br>BF16 · 4.18 GB 自然语言描述设计音色,无需参考音频 Kokoro-82M 1.0 Official 82M Q8 · 189.55 MB<br>BF16 · 211.95 MB 49 种内置音色、多语言生成,不含日语 Kokoro-82M 1.0 82M Q8 · 932.66 MB 54 种内置音色、包含日语的完整多语言资源;仅支持导入 Kokoro-82M 1.1-zh 82M Q8 · 255.32 MB 100 种中文音色及 3 种英文音色;实验性,仅支持导入
@CIYYYT #1
得看模型多少B吧?

不同量级的模型,能塞进的显存也不同,你这也没个稍微带参数的内容。
配音一段10分钟的一般来说需要多少token啊
@TraderYao #2 本地运行的,不需要token