一句话即可自由生成!语音双模型上线
Description
通义实验室语音团队正式发布两款支持 FreeStyle自然语言控制的模型: 🔹 Fun-CosyVoice3.5 —— 声音复刻 + 精细表达 🔹 Fun-AudioGen-VD —— 声音设计 + 场景生成 不选标签,不调参数, 直接用一句话生成你想要的声音与表达。 FreeStyle 新范式,正式上线。
通义实验室语音团队正式发布两款支持 FreeStyle自然语言控制的模型: 🔹 Fun-CosyVoice3.5 —— 声音复刻 + 精细表达 🔹 Fun-AudioGen-VD —— 声音设计 + 场景生成 不选标签,不调参数, 直接用一句话生成你想要的声音与表达。 FreeStyle 新范式,正式上线。
Comments
高德团队呢,用这个优化一下高德的语音包啊,现在除了热门的几个,其他的还是几年前的技术
♥ 17
省流:不开源
♥ 12
文生图,文生视频,这个是真正的文生语音了
♥ 7
所以免费Token呢?[崩坏:星穹铁道_吃瓜ing]
♥ 6
刚刚玩了QWEN-ASR又来一个TTS?[点赞]
♥ 6 ↩ 6
3.0开源,3.5不开源了[吃瓜]
♥ 5 ↩ 6
万一呢[星星眼]
♥ 4 ↩ 7
可以控制重音这种细粒度的吗?
♥ 3
源神没启动[妙啊]
♥ 3
那么在哪里可以用到呢?[星星眼]
♥ 2
[doge]
♥ 2
开源地址在哪里?[星星眼]
♥ 1
听起来效果可与Ming-omni-tts一战
♥ 1
会开吗
♥ 1
呜呜呜,谁不希望自己的视频也有人看哇[大哭]
♥ 1
代码小白实在是搞不动,找了很多AI大语言模型都学不会,赶紧来问下官方: qwen3的TTS真的能用自己的语音训练集进行微调训练吗?我用GPT-sovits效果很差,想试试qwen3,快速语音克隆的效果很差,想试试看这个行不行。 官网文档说有微调训练的方法,但全网没找到几个能讲清楚的,代码小白学起来太痛苦了,接近崩溃。。。 球球了,救救孩子吧!
♥ 1 ↩ 2
哪里可以用?
♥ 1
开源了吗?
♥ 1
测一下…希望这次生成延迟能低一点
♥ 1
这配音绝了[星星眼][星星眼]