Description
自高音质合成模型发布以来,DiffSinger社区迎来了令人振奋的两项重要技术进展:
借助高度自动化的标注流程,制作者仅需标注歌词拼音即可完成标准化数据集的构建;
专门设计的MIDI-less模式提升了音高操控性能,并使得可使用的训练数据范围由歌声数据扩展至语音数据。
视频中展示的模型在总长度为6.72小时、自动化标注的单人男声数据集上使用单张V100显卡训练260k步,推理时未开启加速采样算法。在调音过程中实测开启50~100倍加速采样未见明显音质劣化,CPU亦可无压力实时合成。
相关流程代码已全部开源,即日起任何人都能以十分低廉的成本制作属于自己的DiffSinger声库。
项目开源地址(由我们fork并维护的版本):https://github.com/openvpi/DiffSinger
自制声库教程:https://www.yuque.com/openvpi/tutorial
DiffSinger歌声合成交流群:907879266
挚彬Club交流群(声库内测):1140893459
作曲:塔库
作词:冉语优
编曲:向往
原唱:三无Marblue
引擎:DiffSinger
数据集提供:挚彬Club
声库制作:YQ之神
研发改进/实验指导:yxlllc
训练:九尾玄狐
演唱:挚彬·时羽
调音:赤松_Akamatsu YQ之神
混音:赤松_Akamatsu
可视化:飞弦p
视频制作:赤松_Akamatsu