AI声音克隆又进化了,10分钟学会声音克隆!一键启动包发布!
合集 · 老崔聊AI (75)
-
电脑的隐藏用法,99%的人都不知道!从点鼠标到一句话控电脑!
4:12
-
DeepSeek R1,本地部署才是王道!
4:03
-
都2025年了,这才是我想要的AI软件!
3:37
-
王炸!全网最全AI生成视频教程,绅士必备的一键启动包!
4:42
-
《黑神话·悟空》是用什么编程语言开发的?薪资如何?
4:21
-
AI鲁迅,入驻B站啦!
4:26
-
AI语音生成天花板,效果吊打实测,全网最简单!
3:32
-
AI太刑了,随心掌控的表情和动作!
2:52
-
AI换脸真变态,绅士必备的一键启动包!
4:04
-
【揭秘】图片里不为人知的秘密
3:53
-
王炸!AI声音克隆+Sora开源平替一键启动,全网最简单!
4:23
-
王炸!AI生成视频又进化了,阿里EMO真“变态”!
2:08
-
原神+AI,与AI胡桃谈了一场恋爱!
5:02
-
AI越来越“变态”了,本地部署才是王道!
3:13
-
AI声音克隆又进化了,1分钟训练模型,一键启动包发布!
13:58
-
【AI唱歌】再次进化!6分钟学会用AI唱歌,杀疯了!
6:06
-
【AI绘画】AI又进化了,革命性突破
2:05
-
AI杀疯了!2021年高能的AI算法,超乎想象!
4:59
-
十分钟骗走五万五千元!AI声音模仿有多逼真?5秒
2:50
-
AI杀疯了!2022年保姆级AI算法教程,新年必玩!
10:01
-
AI声音克隆又进化了,10分钟学会声音克隆!一键启动包发布!
8:46
-
学了十年代码,写的真人AI体感游戏
3:37
-
只有想不到,没有做不到的超强AI!
4:05
-
多款AI游戏外挂,原理解析,战斗力爆表,蚌埠住了
7:23
-
写代码全自动炒股,你觉得靠谱吗?
5:41
-
6分钟带你回顾2020年高能的AI算法
5:53
-
AI还原乾隆后妃样貌,延禧攻略众生相。
2:36
-
AI人工智能技术还原康乾盛世三代皇帝样貌,这也太
2:36
-
AI复活明朝历代皇帝,来一场穿越时空的对话!
2:36
-
AI作画保姆级教程来了!逆天,太强了!
11:44
-
AI大胆预测世界杯冠军,用了100年的数据?
1:55
-
太猛了!AI这波杀疯了,原来还能这么聊天!
3:40
-
令人破防!AI一键生成“原创”歌曲《我不想上班》!
4:52
-
用AI换脸赚钱?绅士必备的一键启动包!
3:30
-
王炸!AI声音克隆,AI生成视频技术又进化了!
3:27
-
AI大胆预测欧洲杯冠军,赢麻了?
4:30
-
AI基建狂魔,给了我们哪些新机遇?
4:28
-
如何私人定制神级AI桌宠?
2:55
-
程序员必备技能,解决99%烦恼的秘密武器!
2:47
-
两个逆天AI吵架拌嘴,这节目我能看一天!
3:40
-
【警惕】一个非常危险的 AI 开源了!保姆级 FLUX LoRA 一键启动!
5:37
-
黑神话悟空+AI,我做了一个碎嘴子猪八戒!
2:51
-
这才是我想要的AI客服!
5:43
-
卷疯了,AI写代码JetBrains官方版来了!
4:49
-
五分钟开发一个AI炒股智能体!
6:55
-
AI可太刑了,我们的隐私要如何保障?
5:35
-
现在的AI美女视频,别太离谱!我被AI美女包围了!
3:16
-
王炸!AI视频天花板,随心掌控视频生成,一键启动!
3:00
-
AI太刑了,随心掌控的语音和表情动作!
2:28
-
王炸,开源AI视频天花板,吊打实测!
2:27
-
这就是我想要的AI鬼畜视频,万物一键融合!
1:30
-
用AI私人定制一款24小时陪聊是什么体验?
2:59
-
【揭秘】24小时AI陪聊的秘密
3:23
-
DeepSeek被国外封杀?国内这次卷疯了!
3:04
-
DeepSeek R1,99%的人还不知道的超绝技巧!
4:24
-
【摆脱卡顿】终于用上了稳定满血 DeepSeek-R1!
1:36
-
这才是我想要的AI手机,S25 Ultra初体验!
4:49
-
90%手残党错过的夸克AI,建议收藏!
4:05
-
AI的下一个风口,颠覆你的认知!
5:08
-
谁告诉你这么学编程的?!
2:58
-
个人玩AI用什么GPU最有性价比?
5:47
-
微信克隆人,一个极具争议的开源项目!
4:23
-
微信克隆人,本地部署才是王道,保姆级教程!
4:34
-
暴走AI展,我emo了!
2:41
-
试了这个AI修图,我决定放弃学PS了!
3:27
-
这个暑假,AI视频博主靠什么爆火涨粉?
2:42
-
【揭秘】B站悄悄上线了AI新功能!
3:18
-
重新定义AI编程外挂天花板,这才是我想要的!
3:37
-
居家摸鱼第三年,我做了一个拖延克星...
3:00
-
离谱!我把他们炼成了AI摇子,唱跳合体!
1:56
-
入驻B站,让流量明星破防!
3:38
-
Seedance2.0只是前菜,未来的AI编程会更加疯狂。
4:19
-
用OpenClaw炒股,3位名臣AI让我赚了多少钱?
3:26
-
AI语音天花板,最强开源王炸模型!【附本地安装包】
3:21
-
DeepSeek Harness满血版解锁,99%的人都用错了!
4:41
Description
一键训练启动包的下载地址,关注 & 私信我:vits ,即可获取。 一键训练启动包的下载地址,关注 & 私信我:vits ,即可获取。 一键训练webui代码: https://github.com/Jack-Cherish/dsi/blob/main/vits_script/finetune_webui.py 项目基于vits做的二次开发,原项目地址: https://github.com/Plachtaa/VITS-fast-fine-tuning 教程制作不易,不用三连,有个免费的赞就行!!!!
Comments
搜集了评论区的一些报错,修复了一些问题,最新的一键训练启动包的下载地址:cv25689788 二次开发做了这个webui,方便大家训练自己的tts模型,同时打包了开发环境,一键启动训练,这期视频也是数字人那期视频的音频部分的基础教程,除了声音合成,还有更关键的对话大语言模型的训练、人物形象修复、画面驱动等 AI 算法,后续会陆续开发。 教程制作不易,不用三连,有个免费的赞就行!!!!
♥ 859 ↩ 179
3连,有AI训练自己3D形象的教程么?
♥ 426 ↩ 19
上个月用了50分钟几百条音频,用sovits训练了10万步,折腾了好几天,出来的效果无论转语音还是唱歌都一言难尽,整自闭了[喜极而泣] 感谢大佬的一键整合包,这次准备再折腾几天试试fine tuning的vits效果怎么样
♥ 319 ↩ 42
试了下,4090模型选large,batch_size默认为4也会跑着跑着爆显存[tv_笑哭]
♥ 213 ↩ 22
2023-08-11 21:13:29 【已完成】音频文件命名修改 2023-08-11 21:13:38 音频文件识别失败 2023-08-11 21:13:38 【已完成】音频对应txt文本生成 2023-08-11 21:13:38 【已完成】数据预处理,训练集、验证集切分 2023-08-11 21:13:38 【进行中】开始训练,训练进度请看后台音频文件识别失败是怎么回事,大佬
♥ 202 ↩ 35
一、AI语音合成技术已进化,可上传音频模仿个人声音,甚至能模仿韵律和语气。使用VITS技术可实现文本生成、音色迁移和实时变声等功能。 00:01 - AI语音合成技术又进化了,只需要上传十秒音频,就能模仿你的生命 01:07 - 用AI生成的音频,音色和麦克风录制声音略有区别,但单独听AI合成的音频也很接近 02:21 - VITS技术开发的AI技术,可以生成合成音、音色迁移、实时变声,使用方便 二、如何使用代码进行音频分离、降噪和音频识别,并提供了相关项目的工程包和演示。同时还介绍了如何选择音频识别模型和显存大小的建议。 03:03 - 使用代码进行音频分离和降噪处理 04:44 - 保存音频文件格式为WAV,命名随意 05:56 - 识别效果越好,显存越大 三、如何使用NVIDIA GPU进行音频合成模型的训练和预测,包括显存大小、训练轮次、by size大小等参数的设置,以及如何使用output model进行模型输出。 06:02 - 查看显存大小和训练轮次 07:07 - 训练模型的时长和保存模型 08:29 - 下期视频内容及留言提示 --本内容基于视频内容由模型生成,仅供参考,由@qwe5283 召唤发送
♥ 182 ↩ 8
这个项目中存在大量的问题、bug,以至于相当一部分人无法正常的训练。 其中一部分问题@凛冽冰霜 已经指出,我这里就不复述了。 现在说几个我发现的严重问题: 1.“是否重新训练”,这完全就写错了,变量名其实是“continue_train”,就是“是否继续训练”的意思,后面的程序中的逻辑,也是“是否继续训练” if continue_train == "是": drop_speaker_embed = False cont = True else: drop_speaker_embed = True cont = False 所以如果你选“否”的话,那一定是无法“接着已经保存的模型继续训练”的。 解决这个bug,你既可以修改代码,也可以因陋就简的反着选。
♥ 174 ↩ 25
一键训练启动包的下载地址,关注 & 私信我:vits ,即可获取。 二次开发做了这个webui,方便大家训练自己的tts模型,同时打包了开发环境,一键启动训练,这期视频也是数字人那期视频的音频部分的基础教程,除了声音合成,还有更关键的对话大语言模型的训练、人物形象修复、画面驱动等 AI 算法,后续会陆续开发。 教程制作不易,不用三连,有个免费的赞就行!!!!
♥ 173 ↩ 83
大佬这个对比SoVITS哪个效果更好?
♥ 147 ↩ 10
视频简介: 一键训练启动包的下载地址,关注 & 私信我:vits ,即可获取。 一键训练启动包的下载地址,关注 & 私信我:vits ,即可获取。 一键训练webui代码: 链接见视频简介 项目基于vits做的二次开发,原项目地址: 链接见视频简介 教程制作不易,不用三连,有个免费的赞就行!!!!
♥ 142 ↩ 8
搞了一晚上,终于跑起来了。 简单总结一下我干了啥: 安装自己显卡对应版本的cuda 解决报错1:F:\Code\xxx ... ????? 执行以下两条命...
♥ 73 ↩ 16
老师老师,这对显卡的要求苛刻吗[脸红]
♥ 72 ↩ 22
报错,运行不了
♥ 43 ↩ 48
Hi,Jack。今天下载了启动包,也录好了wave文件准备训练,可是点击“开始训练”提示Error,不知道是什么缘故。是不是需要一定的编程环境,我没有安装vs studio,浏览器用的firefox。请拨冗指点
♥ 43 ↩ 23
DEBUG:httpcore.http11:receive_response_headers.complete return_value=(b'HTTP/1.1', 200, b'OK', 【(b'date', b'Mon, 14 Aug 2023 03:20:50 GMT'), (b'server', b'uvicorn'), (b'content-length', b'16'), (b'content-type', b'application/json')】) INFO:httpx:HTTP Request: POST http://127.0.0.1:8088/reset "HTTP/1.1 200 OK" DEBUG:httpcore.http11:receive_response_body.started request=<Request 【b'POST'】> DEBUG:httpcore.http11:receive_response_body.complete DEBUG:httpcore.http11:response_closed.started DEBUG:httpcore.http11:response_closed.complete 这是嘛回事呀,点开始训练没有反应
♥ 41 ↩ 52
upup,音频文件识别失败是因为什么呢,我是用的mp4通过格式工厂转换到mp3再转换到wav的
♥ 28 ↩ 16
我不管用medium还是large训练,训练不定的时间后,比如十分钟,半小时,就会报这个错。然后我是在文件开头指定过gpu为0的,请问有没有人也遇到过这个情况?附:我是1080ti
♥ 27 ↩ 33
抱歉无法训练,未检测到GPU
♥ 25 ↩ 11
up的整合包能用,如果有一些报错,按照up总结的方法处理不了,可以试着换一下自己的音频文件。我是3606,8g,没安装cuda,一开始训练时总是报错,各种问题,后来我换掉了音频文件,跑通了。自己录音的时候,声音要清晰,吐字清楚,情感幅度小一些。我训练了200步,效果不好,并且不能继续训练,这是个遗憾。
♥ 24 ↩ 3
千万千万不能中断训练,目前是不支持继续训练,我3000多段10s的语音,训练到了1700个了,3090开着跑了6天,后面无意关闭了cmd窗口,再选择否,依然从识别音频开始,相当于6天白跑,一旦中断,只能重头开始,开始训练后电脑不能关闭。
♥ 23 ↩ 14