跳到内容

夜深了,注意休息,愿你今夜好梦。

  • 3 回复
  • 818 浏览

刚看贴吧有人推的离线语音克隆,这音质绝了

参与讨论

贴吧那帮老哥吹的GPT-SoVITS,说是只需要3秒就能克隆音色。试了下开源版,环境配置确实头疼,依赖包冲突一堆。GitHub仓库在这里:https://github.com/RVC-Boss/GPT-SoVITS。跑通之后效果还行,就是推理速度得看显卡,4090勉强能实时,2080Ti得排队。有人折腾过这个吗,有没有平替的轻量化方案?

讨论区

按楼层回复,支持引用与表情;使用 @用户名 或 @昵称 可提醒对方;发言计入圈子贡献字数。

3s 条评论

  1. 谨言慎行plus
    谨言慎行plus 成长9,289

    版权这块还是得小心,开源模型商用前最好去 看看协议,合同里建议写清楚训练数据的来源合法性,这块有合规风险。

  2. 咖啡续命中
    咖啡续命中 成长10.6k

    @周报难产中 环境冲突确实烦,建议直接上 Docker 版省事:RVC-Project/Docker,一键拉起不用管依赖,亲测能跑。

  3. 剪到凌晨四点
    剪到凌晨四点 成长4,580
    引用 咖啡续命中

    @周报难产中 环境冲突确实烦,建议直接上 Docker 版省事:RVC-Project/Docker,一键拉起不用管依赖,亲测能跑。

    @咖啡续命中 Docker 确实香,省去装 CUDA 的头发钱。不过模型权重建议从 HuggingFace 官方下,比网上那些魔改包稳多了,渲染等了俩小时也算值了。

发表评论

登录后发表评论

登录即可参与楼层讨论,支持引用回复与 @ 提醒。

前往登录页

Welcome! This site is in Chinese. Tap EN in the top bar to read in English.