yovoice

把文字,变成有情绪的声音

选一段心仪的音色,调一种对的情绪,把冰冷的稿件变成鲜活的声音

长篇演绎 / 多角色朗读3 种模型01 / 14 80

他脸上黑而且瘦,已经不成样子;穿一件破夹袄,盘着两腿,下面垫一个蒲包,用草绳在肩上挂住;见了我,又说道,“温一碗酒。”掌柜也伸出头去,一面说,“孔乙己么?你还欠十九个钱呢!”孔乙己很颓唐的仰面答道,“这……下回还清罢。这一回是现钱,酒要好。”掌柜仍然同平常一样,笑着对他说,“孔乙己,你又偷了东西了!”但他这回却不十分分辩,单说了一句“不要取笑!”“取笑?要是不偷,怎么会打断腿?”孔乙己低声说道,“跌断,跌,跌……”他的眼色,很像恳求掌柜,不要再提。此时已经聚集了几个人,便和掌柜都笑了。我温了酒,端出去,放在门槛上。他从破衣袋里摸出四文大钱,放在我手里,见他满手是泥,原来他便用这手走来的。不一会,他喝完酒,便又在旁人的说笑声中,坐着用这手慢慢走去了。

00:00 / 01:11准备播放
yovoice

左右滑动,翻阅内页 →

VOICE COLLECTION / 001
声音选集 · 第一辑12 段声音 / 04 种用法
CATALOG
YV-001
TRACKS
01—12

DEMO 随意试听

SIDE A
SIDE A
SIDE B
SIDE B

本地创作,自由发声

文章朗读 · 剧情演绎 · 视频旁白

  1. 写下台词

    从一句问候,到一整个故事

  2. 选择声音

    选一个音色,或复用熟悉的声音

  3. 调整情绪

    让语气贴合文字,再听听效果

yovoice 工作台,包含文字编辑、音色与情绪设置和音频时间轴
WORKSPACE / 01你的本地声音工作台

声音与情绪,由你掌控

yovoice 复古磁带 几秒音频,克隆心仪声线
01 / 音色

复刻声音,或凭空创造

上传或录制一段参考音频,即可提取专属声线;也能直接输入文字描述,为你定制全新音色。

YOVOICE / EXPRESSION
同一句台词,不同的心境

你终于来了,我等你好久了。

轻点切换情绪,感受语气的微妙起伏
02 / 表达

语气到位,表达才真切

是雀跃欢快,还是低沉克制?支持通过情绪标签、参考音频或自然语言提示词(Prompt)微调语气与语调。

注:不同底模支持的控制粒度有所差异
复古桌面电脑,屏幕显示音频波形和已保存的 voice.wav 文件
03 / 纯本地运行

完全离线,不把数据交给云端

一次下载模型,全程在本机推理。没有付费的烦恼,没有网络延迟,你的文稿与声音资产只属于你。

macOS · Windows 跨平台支持
04 / 工作流集成

不只桌面客户端,更是生产力工具

无需打开图形界面,随时把配音能力接入你的自动化流水线。支持通过终端脚本批量渲染,也支持让智能体自主调用。

支持的模型 了解模型能力与许可
yovoice 支持的模型与用途
模型 适合做什么
IndexTTS 2.0 / 2.5 参考音色克隆、情绪控制和参考演绎;2.5 还支持多语言与发音调整。
VoxCPM2 用文字设计音色,或结合参考录音和原文做精细克隆。
OmniVoice 按属性设计音色、音色克隆及非语言声音标签;权重仅限非商业用途。
Qwen3-TTS Base 用于参考音色克隆,CustomVoice 提供内置音色,VoiceDesign 用于文字设计音色。

常见问题

官网这些试听 Demo 是怎么做出来的?

试听由 yovoice 在本地通过 CLI 生成,使用的模型标在每段声音旁。“平静”与“开心”使用相同文本和参考声线,只调整情绪参数。网页播放的是生成好的音频,不会在浏览器中运行模型。

我的音色、作品和模型保存在哪里?

默认存放在本机的 ~/.yovoice 目录下。你的所有文稿、音色资产和模型都在本地掌控。即使卸载客户端,这部分数据也不会被误删;如果更换电脑,直接打包备份该目录即可。

平时使用必须联网吗?

完全离线可用。只有首次安装和在软件内下载模型时需要网络连接。一旦模型下载就绪,所有的声音合成都在本机跑完,不发一个网络请求,断网也能用。

对电脑配置有什么要求?

目前支持两大平台:

  • macOS:macOS 14+ 且搭载 Apple Silicon(M 系列芯片),原生调用 Metal 加速。
  • Windows:Win 10/11 64 位系统,支持 CPU、NVIDIA CUDA 加速,以及实验性的 Vulkan 支持。

注:具体显存和内存占用取决于你运行的模型规格。

生成的声音可以商用吗?

yovoice 软件本身采用 Apache-2.0 开源协议,但商用需以具体模型与声音版权为准:

  1. 不同底模有独立的开源许可(例如 OmniVoice 权重仅限非商业用途)。
  2. 商用前请确保所用模型允许商用,且你合法拥有参考音频的版权或声音授权。
可以让 AI Agent 调用它来自动配音吗?

当然。yovoice 原生提供了独立 CLI 和封装好的 Agent Skill。无需启动桌面图形界面,脚本或 Agent 即可直接输入文本和参考音色一键生成音频。

查看 Agent Skill

yovoice DESKTOP APPLICATION

准备好在本地开启声音创作了吗?

纯本地推理 · 情绪调控 · 声音克隆

获取 yovoice前往 GitHub Releases
macOS 14+Apple SiliconWindows 10/11x64