Description
DiffSinger多说话人模型与声线融合技术现已开放!即日起与亲友伙伴相约,跟随开源教程与代码制作多人声库,即可享受由多人模型为每一位演唱者带来的共同增益,同时开启音色与声线自由融合的全新玩法;对于唱腔多变的专业演唱者,多人模型可实现任意种声线和唱法的自由融合与过渡,极大提高声库上限。
视频中使用的模型在总量约12小时的opencpop、绮萱、夏叶子三人女声数据集上使用单张V100显卡训练320k步,音频合成及音色融合均已取得相关授权。
注意:在训练多人模型前,您必须获得每个数据集的版权所有者的许可,并确保所有这些提供者都完全知悉您将使用他们的数据训练组合模型,您是否会分发合成的声音和模型权重,他们的声音是否会被用于声线融合,以及其他可能的潜在风险。发布使用声线融合功能制作的音频或带有该功能的模型时请遵循每位数据集授权者或声库版权持有者的规约。
项目开源地址(由我们fork并维护的版本):https://github.com/openvpi/DiffSinger
自制声库教程:https://www.yuque.com/openvpi/tutorial
DiffSinger歌声合成交流群:907879266
夏叶子虚拟歌手交流群:775802167
原曲:一半一半(BV1cx411c79i)
原作:鸟爷ToriSama
原唱:洛天依
引擎:DiffSinger
音色设计:OpenVPI Team
研发改进:yxlllc
实验指导:YQ之神
训练:九尾玄狐
演唱:Opencpop、绮萱、夏叶子
调音/混音:笛鹿FlutyDeer
视频制作:至精至简
Comments
给世界一点小小的开源震撼.jpg
♥ 1086 ↩ 25
我是一个今天才知道这种技术的独立音乐制作人,一直以来,和声制作,歌手的各种问题让我一直觉得非常影响效率。 我非常非常非常喜欢这项技术,它让我不用再去处理复杂的人与人之间的事情而可以专注于音乐的创作,无论是制作音频小样,还是在编曲中制作伴唱。甚至是直接生产音乐成品,都非常,非常,非常的有用。 因为经常需要购买一些音乐效果器等软件,尤其大量软件都是国外公司制作,一直让我非常不爽。 你们的技术,如果我把它当商用音源来看,如果一份卖一千。我是肯定会掏钱买的(如果包后续更新就更好了)。 现在你们开源,免费,最重要的是,你们是中国人,还走在世界的前列,我真的非常非常非常激动。 心情难以平复,不知所云,多多包涵。[支持]
♥ 473 ↩ 16
唉,只能说是时代不同了,当年我拿歌姬混和音色还会被人喷,现在已经变成习以为常的事情了。新的科学技术就会产生新的道德准则,以前不能做的事情现在可以随便做了。
♥ 374 ↩ 11
不知道佛祖们有没有兴趣尝试一下男声和女声之间的线性过渡,感觉给人的震撼可能更大
♥ 211 ↩ 10
动态转换真的很酷,不过我感觉过去的v家声库还有u家的,都和虚拟人设绑定的,就有点习惯了一个人设包括多个亚种和一个声库匹配,这种两个声库融合还得慢慢适应hhh
♥ 145 ↩ 5
额,怎么说,合并的声线好像不稳定?同一个合成样本感觉咬字和音色在变诶
♥ 122 ↩ 18
给世界一点小小的开源震撼[打call]
♥ 100
使用教程:https://www.yuque.com/sunsa-i3ayc/sivu7h(是谁忘记demo日期维护撞上我不说[大哭])
♥ 74 ↩ 4
你这个牛夫人剪影太有那味了救命[笑哭]还有这pv也是,牛的
♥ 55 ↩ 2
音色和ACE的绮萱不太一样
♥ 55 ↩ 10
有的人说,有了AI生成/合成技术之后,艺术就没有创新了,因为没有人愿意去创造独特的风格了。这句话有失偏颇,在AI生成之后,模型的融合就和配药一般,提供创新的来源,一个合适的配方,或许就能调配出可口可乐。
♥ 31 ↩ 1
开源永远的神[打call]
♥ 31
很棒哎,不过感觉好像和ACE捏声线一样,虽然看起来拉的数值都是50%,但是音高会影响听起来更像哪个歌姬的声线(?)
♥ 26 ↩ 1
up可不可以做一期分辨AI和真人的视频啊,听虚拟歌姬时间不长几乎都是考音色分辨AI[doge]没听过的不认真听是一点也感觉不到的,有没有特别明显的特征啊
♥ 16 ↩ 6
感觉还能听出来一点点合成音的感觉,不过融合实在是太强啦
♥ 15 ↩ 4
教程的链接失效了诶[YUKIri_鱼鱼萌吃惊]
♥ 15 ↩ 2
哇!激动了!
♥ 13 ↩ 4
技术不断进步[冬日颂歌欧皇套装_6][热词系列_新年快乐]
♥ 7
给他们来一点小小的开源震撼[doge]
♥ 6