【全流程】DiffSinger自制虚拟歌姬教程扩展版

Parts

  1. P1 · 【P1】关于合法利用AI的声明及AI语音学/SVS技术背景介绍
  2. P2 · 【P2】为DiffSinger准备设备和数据
  3. P3 · 【P3】使用DiffSinger训练虚拟歌姬并试唱
  4. P4 · 【P4】使用SynthesizerV和OpenUTAU让DiffSinger虚拟歌姬唱得更好听
  5. P5 · 【Extra】一点AI伦理规则的想法
Description
利用OpenVPI开源团队改进的DiffSinger使用自制、有授权以及开源数据制作AI歌姬!
涵盖背景简介、数据准备、AI训练、演唱调教、AI伦理方面的讨论。
=======================================================
浙江大学DiffSinger项目:https://github.com/MoonInTheRiver/DiffSinger
OpenVPI DiffSinger项目:https://github.com/openvpi/DiffSinger
OpenVPI核心成员传送门:(包括但不限于)@孙飒_TS @YQ之神 @yxlllc 等
OpenVPI DiffSinger原始教程:https://www.yuque.com/openvpi/tutorial
OpenVPI DiffSinger 交流群:907879266
OpenSVIP工程转换器项目:https://openvpi.github.io
OpenVPI DiffSinger社区声码器企划:https://openvpi.github.io/vocoders/
OpenCPOP开源数据集:https://wenet.org.cn/opencpop/download/
M4Singer开源数据集:https://github.com/M4Singer/M4Singer
OpenAI Whisper: https://github.com/openai/whisper
OpenUTAU DiffSingerPack:https://github.com/xunmengshe/OpenUtau/releases
OpenUTAU 交流群:485658015
@Well404 的切分标注工具:https://github.com/Well2333/VoiceS
@冷月2333 音频预处理:https://github.com/fishaudio/audio-preprocess
@冷月2333 声码器增强:https://github.com/fishaudio/fish-diffusion

Comments

橙味比巴卜 2023-03-13

如果有机会把我自己喂进去试试[吃瓜]

♥ 104 ↩ 5

一点小小的AI震撼 2023-03-15

能制作歌词以及和歌词配套的音乐midi,但是主要难点在于拿不到歌手的midi,也不会写,f0就更不懂了[doge]

♥ 52 ↩ 15

叶靖云_ 2023-04-21

感谢lz分享~我主要是需要学习怎么训练的技术部分,至于录音部分,因为我本身就是个混音师,想要小小补充一下关于录音素材准备的部分,我不太同意推荐女生用电容男声用动圈这样的说法。声压通常来说常见电容麦可以承受的声压是104,除非你是打鼓和极端嗓,否则男女正常唱歌一般都不会超过的。你听陈奕迅唱的u87吗?这是他的御用麦克风。真正决定你应该用电容还是动圈的应该是声学环境和唱功。电容可以录进去更多的细节,低频和超高频。但是如果环境不好,唱功不好,就会录进去更多杂音和一些唱功问题【例如卡痰、口水、喉咙摩擦……】,动圈缺乏细节但是声音干净,一般可能中低频会比较多。没有声学装修的家庭录音闭着眼睛选动圈。 用电容麦记得区分有没有自带供电,你推荐的blueyeti就是不需要声卡的usb麦克风~以上

♥ 50 ↩ 3

亚丝娜 2023-03-26

up你好,我看需要录制声音要求很严格,所以svs是根据自己唱歌习惯生成的歌吗[tv_呆]所以假如我唱歌跑调的话,是不是生成的也会跑[笑哭]。不是sovits那样直接转换声音。[小电视_赞][小电视_赞]

♥ 46 ↩ 4

梅花三弄再回首 2023-05-03

难倒我的不是复杂的数据处理或代码运行,而是高质量的数据集的采集和较为苛刻硬件条件…… 没钱买显卡,只能考虑租服务器了 不知道diff有没有paddle版的,如果有的话就可以白嫖算力了[吃瓜]

♥ 44 ↩ 6

嘟比Dubi 2023-03-12

转发评论等于学了!什么时候做我的[doge]

♥ 30 ↩ 1

AK_星空之舞 2023-03-12

码了,上岸之后一定学(也不一定能会) [笑哭]

♥ 25 ↩ 2

散沙PythonPlayer 2023-03-13

虚拟之声活动还有40天了,还有机会赶紧转发上车学习DiffSinger,无内鬼 @大家的音乐机 [微笑]

♥ 16

这网管 2023-03-23

说来基于Diffsinger生成的模型能够用于实时变声吗?[思考]

♥ 14 ↩ 8

江陵_Official 2023-03-12

我终于知道为什么之前有人说看一眼就知道是什么歌了[tv_思考]

♥ 12 ↩ 1

账号已注销 2023-04-19

如果数据集里缺少某一种音素,可以用diffsinger生成出这种音素吗

♥ 10 ↩ 1

邢胖胖_ 2023-12-19

请问20到30分钟的干声大概能训练出什么效果,想把自家的UTAU声库升级AI但懒得再录音频了[呲牙]

♥ 9 ↩ 3

kenneth104 2023-03-13

[滑稽]我已经把媳妇喂出了个Ai画画的Lora模型,还有待优化。。。后面看看语音,唱歌这类,显存只有8G

♥ 8 ↩ 1

猫咪小魔王 2024-01-02

亲,教程链接失效了。可以补一下吗[给心心]

♥ 7

匀子Cyrena 2023-03-12

涨知识了[热词系列_妙啊]支持散沙老师[脱单doge]

♥ 7 ↩ 1

小喷菇-欣琪 2024-08-13

有没有更简约的教程? 我就想立即知道该怎么自制声库和训练 但是看了教程很复杂 看不懂

♥ 6 ↩ 1

猎野战魂 2025-04-07

语雀那个教程没了

♥ 5 ↩ 1

C_C我眼镜呢 2023-04-01

哇,牛啊,我正寻思我自己整不明白

♥ 4

windylam 2023-03-25

diffsinger与现在流行的sovits还有diff-svc是一个类型的吗

♥ 4 ↩ 1

诗意的李尔基 2024-09-25

up主。这个训练什么时候能够像sovits那样简单,教程一次一次的丢失了我

♥ 3