Description
DiffSinger多说话人模型与声线融合技术现已开放!即日起与亲友伙伴相约,跟随开源教程与代码制作多人声库,即可享受由多人模型为每一位演唱者带来的共同增益,同时开启音色与声线自由融合的全新玩法;对于唱腔多变的专业演唱者,多人模型可实现任意种声线和唱法的自由融合与过渡,极大提高声库上限。
视频中使用的模型在总量约12小时的opencpop、绮萱、夏叶子三人女声数据集上使用单张V100显卡训练320k步,音频合成及音色融合均已取得相关授权。
注意:在训练多人模型前,您必须获得每个数据集的版权所有者的许可,并确保所有这些提供者都完全知悉您将使用他们的数据训练组合模型,您是否会分发合成的声音和模型权重,他们的声音是否会被用于声线融合,以及其他可能的潜在风险。发布使用声线融合功能制作的音频或带有该功能的模型时请遵循每位数据集授权者或声库版权持有者的规约。
项目开源地址(由我们fork并维护的版本):https://github.com/openvpi/DiffSinger
自制声库教程:https://www.yuque.com/openvpi/tutorial
DiffSinger歌声合成交流群:907879266
夏叶子虚拟歌手交流群:775802167
原曲:一半一半(BV1cx411c79i)
原作:鸟爷ToriSama
原唱:洛天依
引擎:DiffSinger
音色设计:OpenVPI Team
研发改进:yxlllc
实验指导:YQ之神
训练:九尾玄狐
演唱:Opencpop、绮萱、夏叶子
调音/混音:笛鹿FlutyDeer
视频制作:至精至简