logo NodeSeekbeta

做有声自媒体的别买配音包了!yovoice 支持多角色演绎啦

yovoice 即将上线的新版本正式支持本地多角色演绎。可以零成本在本地创建多人有声故事。对于做相关自媒体的人来说,可谓是重大利好。整一张好点的显卡,可以无限输出内容。

image

  • @CIYYYT #1

    模型 参数量 模型文件大小(按精度) 核心能力
    IndexTTS 2.0 — Q8 · 3.63 GB<br>F16 · 4.65 GB<br>ORIG · 8.08 GB 中英音色克隆、情绪控制、参考演绎
    IndexTTS 2.5 — Q8 · 3.50 GB<br>F16 · 4.55 GB<br>ORIG · 7.89 GB 多语言音色克隆、情绪控制、发音调整
    VoxCPM2 2B Q8 · 2.96 GB<br>BF16 · 4.77 GB<br>ORIG · 4.96 GB 文字设计音色、音色克隆、参考原文辅助的精细克隆
    OmniVoice 0.6B Q8 · 1.35 GB<br>BF16 · 1.64 GB<br>F16 · 1.64 GB 属性设计音色、音色克隆、非语言声音标签
    Qwen3-TTS Base 0.6B Q8 · 1.99 GB<br>BF16 · 2.52 GB 参考音色克隆、可选原文辅助、多语言生成
    Qwen3-TTS Base 1.7B Q8 · 2.70 GB<br>BF16 · 4.20 GB<br>ORIG · 4.54 GB 参考音色克隆、可选原文辅助、多语言生成
    Qwen3-TTS CustomVoice 1.7B Q8 · 2.82 GB<br>BF16 · 4.18 GB 9 种内置音色、文字控制风格与情绪
    Qwen3-TTS VoiceDesign 1.7B Q8 · 2.82 GB<br>BF16 · 4.18 GB 自然语言描述设计音色,无需参考音频
    Kokoro-82M 1.0 Official 82M Q8 · 189.55 MB<br>BF16 · 211.95 MB 49 种内置音色、多语言生成,不含日语
    Kokoro-82M 1.0 82M Q8 · 932.66 MB 54 种内置音色、包含日语的完整多语言资源;仅支持导入
    Kokoro-82M 1.1-zh 82M Q8 · 255.32 MB 100 种中文音色及 3 种英文音色;实验性,仅支持导入
  • 得看模型多少B吧? xhj027
    不同量级的模型,能塞进的显存也不同,你这也没个稍微带参数的内容。 xhj027

  • 配音一段10分钟的一般来说需要多少token啊

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

📈用户数目📈

目前论坛共有72007位seeker

🎉欢迎新用户🎉