几秒音频,克隆心仪声线
复刻声音,或凭空创造
上传或录制一段参考音频,即可提取专属声线;也能直接输入文字描述,为你定制全新音色。
选一段心仪的音色,调一种对的情绪,把冰冷的稿件变成鲜活的声音
他脸上黑而且瘦,已经不成样子;穿一件破夹袄,盘着两腿,下面垫一个蒲包,用草绳在肩上挂住;见了我,又说道,“温一碗酒。”掌柜也伸出头去,一面说,“孔乙己么?你还欠十九个钱呢!”孔乙己很颓唐的仰面答道,“这……下回还清罢。这一回是现钱,酒要好。”掌柜仍然同平常一样,笑着对他说,“孔乙己,你又偷了东西了!”但他这回却不十分分辩,单说了一句“不要取笑!”“取笑?要是不偷,怎么会打断腿?”孔乙己低声说道,“跌断,跌,跌……”他的眼色,很像恳求掌柜,不要再提。此时已经聚集了几个人,便和掌柜都笑了。我温了酒,端出去,放在门槛上。他从破衣袋里摸出四文大钱,放在我手里,见他满手是泥,原来他便用这手走来的。不一会,他喝完酒,便又在旁人的说笑声中,坐着用这手慢慢走去了。
左右滑动,翻阅内页 →
DEMO 随意试听
文章朗读 · 剧情演绎 · 视频旁白
从一句问候,到一整个故事
选一个音色,或复用熟悉的声音
让语气贴合文字,再听听效果
几秒音频,克隆心仪声线
上传或录制一段参考音频,即可提取专属声线;也能直接输入文字描述,为你定制全新音色。
你终于来了,我等你好久了。
是雀跃欢快,还是低沉克制?支持通过情绪标签、参考音频或自然语言提示词(Prompt)微调语气与语调。
注:不同底模支持的控制粒度有所差异
一次下载模型,全程在本机推理。没有付费的烦恼,没有网络延迟,你的文稿与声音资产只属于你。
| 模型 | 适合做什么 |
|---|---|
| IndexTTS 2.0 / 2.5 | 参考音色克隆、情绪控制和参考演绎;2.5 还支持多语言与发音调整。 |
| VoxCPM2 | 用文字设计音色,或结合参考录音和原文做精细克隆。 |
| OmniVoice | 按属性设计音色、音色克隆及非语言声音标签;权重仅限非商业用途。 |
| Qwen3-TTS | Base 用于参考音色克隆,CustomVoice 提供内置音色,VoiceDesign 用于文字设计音色。 |
试听由 yovoice 在本地通过 CLI 生成,使用的模型标在每段声音旁。“平静”与“开心”使用相同文本和参考声线,只调整情绪参数。网页播放的是生成好的音频,不会在浏览器中运行模型。
默认存放在本机的 ~/.yovoice 目录下。你的所有文稿、音色资产和模型都在本地掌控。即使卸载客户端,这部分数据也不会被误删;如果更换电脑,直接打包备份该目录即可。
完全离线可用。只有首次安装和在软件内下载模型时需要网络连接。一旦模型下载就绪,所有的声音合成都在本机跑完,不发一个网络请求,断网也能用。
目前支持两大平台:
注:具体显存和内存占用取决于你运行的模型规格。
yovoice 软件本身采用 Apache-2.0 开源协议,但商用需以具体模型与声音版权为准:
当然。yovoice 原生提供了独立 CLI 和封装好的 Agent Skill。无需启动桌面图形界面,脚本或 Agent 即可直接输入文本和参考音色一键生成音频。
纯本地推理 · 情绪调控 · 声音克隆
微信扫码,关注公众号