2小时轻松入门GPT-SoVITS,包含整合包,autodl,colab教程,搭配文档观看

合集 · GPT-SoVITS (13)

  1. 8:00
    【GPT-SoVITS】30小时超大数据集测试,堆时长真的有用吗?
  2. 5:42
    GPT-SoVITS首发评测,速度快10倍,从数据集长度和轮数测试
  3. 2:03:32
    2小时轻松入门GPT-SoVITS,包含整合包,autodl,colab教程,搭配文档观看
  4. 5:54
    情感分类训练,GPT-SoVITS情感特化模型效果及教程
  5. 2:34
    崩铁全角色GPT-SoVITS模型分享
  6. 3:14
    原神全角色GPT-SoVITS模型分享,在线合成
  7. 1:03
    崩三全角色GPT-SoVITS模型分享
  8. 0:51
    绝区零全角色GPT-SoVITS模型分享
  9. 1:09
    星铁全角色GPT-SoVITS-V2模型升级
  10. 1:22
    原神全角色GPT-SoVITS-V2模型升级
  11. 11:19
    终于有会说粤语的AI了!
  12. 2:45
    原神,鸣潮,星铁全角色多语言GPT-SoVITS-V2模型分享
  13. 39:09
    2025最新GPT-SoVITS教程.2025.12.03
Description
文档链接:https://www.yuque.com/baicaigongchang1145haoyuangong/ib3g1e?# 《GPT-SoVITS指南》
视频讲的不是很详细,请对照着文档看
感谢花儿不哭,海鱼Harry的共同编写。感谢项目的所有贡献者
我的小交流群:941610468
字幕:自动识别(过几天我会重新上传字幕的)

Comments

ForYuriHeavenly 2024-03-30

大佬才初中吗,真的厉害。我大学了,也只是个废物。 感谢大佬的教程

♥ 437 ↩ 11

黄油喵包 2024-02-26

大佬,kaggle绑定手机号之后可以每星期白嫖30小时的两块t4,而且支持虚拟手机号,感觉也可以搞搞。 下面是我的一些私心: 我之前fork了一份kaggle上一个大佬基于colab修改的版本,但是似乎安装依赖的时候报错了,我问gpt,貌似说和kaggle预安装的依赖有冲突 然后我本身是基于github上一个大佬修改api.py想用kaggle搞api连sillytavern的,改了下kaggle大佬的脚本但是连不上,那个大佬原来的webui似乎能连上,但是我因为对音声每啥需求,所以没去细究webui。 因为以上这些,所以我就想会不会是安装依赖的缘故导致运行出错,我是个代码小白,只会问ai,很多具体的问题还是得大佬来解决,所以希望大佬能看看。 如果大佬有精力,希望可以搞一份kaggle版本的notbook,最好python api.py的时候可以连上sillytavern(小声逼逼)[给心心][给心心][给心心]

♥ 156 ↩ 9

油条嘻说 2024-03-29

中考????放学???我的天啊,嫉妒让我吃不下饭[大哭][大哭][大哭]

♥ 144 ↩ 1

溪-木 2024-05-06

讲的很棒很细致,话说网上关于声音模型的东西好多好多鸭,就声音模型来说,有GPT sovits,bert vitis2,sovits4.1,RVC,DDSP6.0之类的。我知道有的是变声有的是唱歌有的又说是语音,但是功能又有交错,真的不知道啥好。每个的相关视频都说自己的非常优秀[灵魂出窍]

♥ 79 ↩ 6

imNorthfar 2024-06-09

感谢up和花儿不哭,体验了一下,有以下几点感受,供各位同学参考: 1、我的干音(10min)是在普通室内用dji mic录制的,所以没有用up推荐的uvr处理,而是在au用匹配响度,再用iZotope VEA,再降噪,再动态的方式,再手动把频谱率显示器中没有删除干净的气口弄干净。 2、打标因为我是比较早期的mac电脑,所以我就直接用腾X云的云电脑在线打标了。 3、最后在1Ba-SoVITS训练16轮4轮保存一次,1Bb-GPT训练30轮5轮保存一次(开启dpo) 4、感觉效果距离示例还是差距很远,不知道是不是干音的问题。 另外想请教一下各位同学,有没有什么更好更快的处理干音的方法?或者说干音数据集的质量,怎么样算是高?怎么样算是低?

♥ 79 ↩ 5

宫里立库丝 2025-03-10

up主居然是初中生吗,在读飞舞大学生汗流浃背了[灵魂出窍]

♥ 49 ↩ 5

大怪兽们的新娘 2024-07-02

原本想趁着暑假试试,但是我鸡哥4060被一句话劝退,怕把老家点了。有没有做过的老哥分享一下这个危险程度

♥ 41 ↩ 13

满天星Hoshi 2024-06-13

CPU可以训练小的模型,数据集五分钟 CPU:i5 12400f 内存:32GB batch_size:1(未开启dpo) 训练:SoVITS大约0.2it/s,GPT大约1.02it/s(未开启dpo) sovits,8轮用时约72分钟,gpt,10轮用时约20分钟 显卡是6600占用5%-7%应该没有调用

♥ 40 ↩ 4

绿菟葵花精灵王 2024-03-25

我遇到的问题是"2-name2text-0.txt" + "os. environ[" CUDA_VISIBL……",我已经替换了使用cpu训练的文件,找了半天,路径没错,音频没杂音,最后发现把gpu卡号那里的“-”删了换成“0”,就好了,我没有试过其他数字……不知道有多少人是用cpu摁炼的,但是希望能帮助到大家吧[笑哭]

♥ 38 ↩ 6

抟扶摇直上九重霄 2024-03-23

感觉up快被低级问题和偷懒问题烦死了,hh

♥ 27

newnerr 2024-02-27

Up,看了教程如果使用audl到了后续推理,说是“本地推理”,这个只能在自己机器上推理?因为本来机器不行用audl,到了最后一步还是要自己机器?谢谢

♥ 25 ↩ 4

増殖する寄ー 2024-02-26

尝试用cpu试试,到一键三连时报错了,查看语雀文档就是报错合集创建logs时的那个报错2-name2text-0。 已经提前换好了两个cpu文件,但是报错合集里写的是没有能用的n卡,没有给出解决方案。 检查过路径填写没有问题,这里是我测试用的cpu也不合格还是必须要n卡,如果必须要用n卡的话,前面替换的cpu文件是只能给一部分cpu用?

♥ 20 ↩ 1

我的菜超甜 2024-05-11

我没有看到go-webui.bat 只有go-webui。。。为啥,点开go-webui说:系统找不到 指定路径,请按任意键

♥ 19 ↩ 18

锑元素别来沾边 2024-04-11

谢谢大佬,简直喂饭教程,我这个中年人都能看懂,跟着操作。

♥ 17

白菜工厂1145号员工 2024-02-26

实在抱歉忘记调整响度了,马上改……

♥ 19 ↩ 3

乐枫歆 2024-04-24

up不好意思啊,我是先按照教程下完的文件才看的视频,不知道在线下载需要扣您的费用,实在抱歉。给冲个月卡的电希望能帮您稍微止损,感谢教程,很完备!

♥ 11

bili_95859204327 2024-06-11

为什么我在使用GPT-SoVITS的时候,除了beta0217这个比较早的版本以外,其他新的版本,都是在语音切割那一步就失败了,虽然输出信息那里显示输出成功,但是\output\slicer_opt文件夹里什么也没生成,但是beta0217这个版本就能生成,但是即使是0217这个版本也是有时候成功有时候显示都成功了,但是GPT模型列表和SoVITS模型列表里都不显示新训练出来模型,文件夹里也没有

♥ 10 ↩ 3

浅入眸 2024-09-17

兄弟们,你们有没有遇到过这种情况, 我没有训练模型,就用的默认的推理 推理完成后生成的文件没有声音,控制台也没有什么问题

♥ 9 ↩ 18

巨可爱的-L先生 2024-06-30

大佬,为啥我显示训练完成了,但是两个文件夹始终没有文件[笑哭][笑哭]

♥ 8 ↩ 9