Yovoice本地大模型语音生成工具(支持最新的本地TTS大模型,无需调用云端 API)

AI
AI文摘 此内容由AI根据文章内容自动生成
AI Summary

软件介绍

支持文字转语音,也支持克隆声音和调整情绪,适用于 macOS 和 Windows 的开源声音创作工具,在本地将文字转化为自然、富有表现力的语音。支持音色复刻、情绪控制与音频作品管理,可自主选择 TTS 模型,无需调用云端 API,也没有按字数计费的开销,让旁白、配音和有声内容创作更自主、更低成本。

下载地址

本地创作

  1. 写下台词从一句问候,到一整个故事
  2. 选择声音选一个音色,或复用熟悉的声音
  3. 调整情绪让语气贴合文字,再听听效果
yovoice 工作台,包含文字编辑、音色与情绪设置和音频时间轴

支持模型

模型参数量模型文件大小(按精度)核心能力
IndexTTS 2.0—Q8 · 3.63 GB
F16 · 4.65 GB
ORIG · 8.08 GB
中英音色克隆、情绪控制、参考演绎
IndexTTS 2.5—Q8 · 3.50 GB
F16 · 4.55 GB
ORIG · 7.89 GB
多语言音色克隆、情绪控制、发音调整
VoxCPM22BQ8 · 2.96 GB
BF16 · 4.77 GB
ORIG · 4.96 GB
文字设计音色、音色克隆、参考原文辅助的精细克隆
OmniVoice0.6BQ8 · 1.35 GB
BF16 · 1.64 GB
F16 · 1.64 GB
属性设计音色、音色克隆、非语言声音标签
Qwen3-TTS Base0.6BQ8 · 1.99 GB
BF16 · 2.52 GB
参考音色克隆、可选原文辅助、多语言生成
Qwen3-TTS Base1.7BQ8 · 2.70 GB
BF16 · 4.20 GB
ORIG · 4.54 GB
参考音色克隆、可选原文辅助、多语言生成
Qwen3-TTS CustomVoice1.7BQ8 · 2.82 GB
BF16 · 4.18 GB
9 种内置音色、文字控制风格与情绪
Qwen3-TTS VoiceDesign1.7BQ8 · 2.82 GB
BF16 · 4.18 GB
自然语言描述设计音色,无需参考音频
Kokoro-82M 1.0 Official82MQ8 · 189.55 MB
BF16 · 211.95 MB
49 种内置音色、多语言生成,不含日语
Kokoro-82M 1.082MQ8 · 932.66 MB54 种内置音色、包含日语的完整多语言资源;仅支持导入
Kokoro-82M 1.1-zh82MQ8 · 255.32 MB100 种中文音色及 3 种英文音色;实验性,仅支持导入

支持ai调配

将 yovoice Skill 链接发给 Agent,让它安装 Skill,并准备本地 CLI、引擎和模型:

安装这个 Skill,并帮我配置好 yovoice 本地语音生成环境:https://github.com/leemysw/yovoice/tree/main/skills/yovoice

之后直接描述需求:

用 voice.wav 的音色朗读 narration.txt,语气平静,保存为 narration.wav。

Agent 通过独立 CLI 完成配音,无需打开桌面应用。详细用法见 CLI 指南。

© 版权声明
THE END
点赞7分享
及时反馈~ 抢沙发

请登录后发表评论

    暂无评论内容