人人都是大导演!通义万相2.2来了!🤩

合集 · 通义前哨站 (71)

  1. 1:02:05
    【直播回放】ICLR 2025论文解读(上)——通义实验室篇
  2. 1:11
    智能体工作流评估新框架:WorFBench
  3. 1:20
    这是通义千问的来时路。
  4. 15:23
    从单图到可驱动3D数字人生成技术讲解
  5. 1:15
    有人问Qwen2.5-Omni 和VL的区别?
  6. 1:27:46
    【直播回放】ICLR 2025论文解读(下)——通义实验室篇
  7. 2:03
    通义万相2.1的3D VAE是什么?
  8. 1:29
    多模态大模型解题新思路:mPLUG-Owl3
  9. 0:42
    行业首发全栈MCP服务,尽在百炼平台~
  10. 1:29
    通义万相2.1首尾帧生视频模型开源
  11. 1:23
    【玩转MCP】手把手教你自定义部署MCP服务
  12. 1:23
    【玩转MCP】手把手教你搭建专属MCP Agent
  13. 1:57
    超写实3D数字人大模型(LAM)技术报告解读
  14. 1:34
    表情、声音、说话风格一键复刻!
  15. 0:23
    我们为千行百业而来。
  16. 0:40
    Qwen3 来了!
  17. 1:20
    Thinking Budget:让大模型灵活思考
  18. 0:56
    Qwen3+MCP带来哪些新场景?
  19. 1:00
    太好了,是Qwen的Deep Research,我们有救了
  20. 1:07
    通义万相视频编辑统一模型VACE开源发布
  21. 10:01
    【直播回放】通义万相视频编辑统一模型VACE开源
  22. 2:14
    如果有Wan Day,它会是什么样子?
  23. 2:42
    ZeroSearch:无需真实搜索也能激发模型搜索能力
  24. 3:24
    今天来复习一下Qwen2.5-VL技术报告!
  25. 3:15
    ParScale:一种全新的大模型Scaling Law
  26. 2:01
    大模型如何持续进化,实现精准检索?
  27. 59:14
    【直播回放】Qwen3-Embedding模型深度解析
  28. 2:40
    语音识别怕噪声?CoGenAV 来破局!
  29. 0:37
    在这里,了解通义千问的一切
  30. 1:36
    微表情捕捉、潜台词翻译,AI“读心专家”就位!
  31. 1:47
    理解画面捕捉细节,你的AI音效师来啦!
  32. 5:03
    框架开源,无需邀约,即刻体验!
  33. 0:57
    Qwen Vlo|描绘你关于世界的想象
  34. 1:51
    10分钟,打造你的专属实时语音交互应用!
  35. 1:41
    手机也能跑 Qwen3?手把手教你部署!
  36. 1:10
    一句话玩转网页开发!
  37. 1:04:15
    【直播回放】Ask Qwen3 Anything 2025年04月30日10点场
  38. 52:16
    如何让AI有理有据地识别情绪?
  39. 5:10
    来吧,上船,起航!
  40. 1:16
    👂听说,Qwen3-Coder其实也能听懂大白话?
  41. 1:57
    人人都是大导演!通义万相2.2来了!🤩
  42. 1:05
    Github 5K+🌟WebAgent研究团队新作:WebShaper来啦
  43. 1:57
    书画双全!Qwen-Image开源🖌
  44. 2:04:47
    【直播回放】Qwen-Image技术报告解读和模型实战攻略01
  45. 1:05
    音画传情 声启万相
  46. 3:39
    什么呀?语音识别现在也要调监控啦🧐?
  47. 4:03
    AgentScope1.0:终结智能体黑盒🗃️,打造生产级可控应用
  48. 1:41
    🎙️ 开麦即真:CosyVoice 全面升级
  49. 1:20
    不止入戏,更能入景🎬
  50. 2:35
    说得更好、更准、更自然:Qwen3-TTS上线
  51. 6:55
    原生全模态不降智
  52. 2:03
    Qwen3-VL 看懂、理解并响应世界
  53. 0:58
    多图编辑进化,万物皆可一键“同框”!
  54. 0:41
    大就是好!Qwen3-Max 正式亮相
  55. 0:41
    通义万相2.5:一句指令,玩转图像魔法
  56. 0:44
    别让声音困住你的效率
  57. 0:47
    通义万相2.5:一句话实现“Vibe PSing”!
  58. 0:48
    通义万相2.5:让声音当你的视频“导演”!
  59. 1:21
    通义万相2.5:让画面“声”动起来!
  60. 0:54
    通义万相2.5:能听懂,也能准确执行!
  61. 4:52
    Qwen3-Omni API上新:声形意合,令出智随
  62. 1:15
    Fun-CosyVoice 3 重磅升级|更快、更准、更强表达力
  63. 1:21
    Fun-ASR 全新升级|企业级抗干扰
  64. 0:39
    「通义万相2.6」来啦!所有角色,听我指挥
  65. 0:51
    Qwen-Image-Layered:下一代图像生成基础模型 🚀
  66. 0:55
    进来复习!是谁8步推理1秒出图
  67. 1:39
    【能干活的高情商语音搭子】
  68. 3:19
    Qwen3-TTS上新,支持跨物种克隆音色!
  69. 0:57
    Qwen-Image-2512 正式开源发布!
  70. 1:16
    除夕!Qwen3.5来了!
  71. 2:53
    Qwen-Audio-3.0-Realtime 发布:懂倾听,更聪明的实时语音方案
Description
🎉通义万相Wan2.2开源发布!这次一口气发布了三款模型,包括文生视频、图生视频和一款统一视频生成模型。最棒的是其中5B的统一版本,消费级显卡就能跑起来!
💡 技术亮点,有点东西!
业内首创MoE架构  😎:业界第一个把MoE架构用在视频生成的模型。简单说,就是有两个“专家”分工合作,一个“高噪专家”负责搭建视频的整体框架,一个“低噪专家”精雕细琢画面细节。
海量数据+美学训练  🎨:模型用海量的视频和图片数据进行了训练,图像数据增加了65.6%,视频数据增加了83.2% 6!还专门进行了“美学精调”,学习了电影里的光影、构图和色彩,让视频更好看。
高压缩比,超高效  ⚡:5B 模型,采用了超高压缩比的3D VAE技术,大大减少了显存占用,让大家在自己电脑上玩转AI视频成为可能。
✨ 功能亮点,言出Wan行!
电影级美学控制  🎬:重磅推出了“电影级美学控制系统” !提供了超过60个专业参数,让你像导演一样控制光影、构图和色彩。输入“黄昏”、“背光”、“对称构图”这些词,就能get到电影感大片。
复杂动作超稳  👍:无论是街舞、体操这种大幅度运动,还是细腻的微表情、手势,甚至是多人互动,生成的画面都超级流畅自然,细节满满。
神还原现实世界  🌍:遵循物理规律的能力也大大增强!你用文字描述,它就能精准理解,稳定生成包含多个物体互动、空间感超强的逼真场景。
📄 这些地方,立即体验!
通义万相官网
模型文件下载:魔搭社区、HuggingFace、Github API服务:阿里云百炼

Comments

天师钟馗VIP 2025-07-28

14B的4090 48G跑不动,坐等量化版本哦,5B也要跑200多秒,效果很不错

♥ 34 ↩ 7

看不见丶小透明 2025-07-28

支持人体工程学吗[doge]

♥ 14 ↩ 2

大机灵鬼一 2025-07-29

出个在线服务吧,绝大多数人都不应该在ai上堆显卡,因为ai大模型的每次更新的效果提升都要比自己手搓烧脑的提升大,与其天天显卡焦虑,不如躺平觉得好用就付费去用,希望官方重视这块,像可灵,海螺的在线服务做的都挺好,赶紧出一个吧

♥ 13 ↩ 4

快冲 2025-07-29

太伟大了通义[Neuro sama动态表情包_姐姐打call]

♥ 8

难猜的用户 2025-07-28

1.Wan 2.2 系列也发布了图片生成模型(图1) 2.Wan 系列以前就有音效生成了(图2,链接:https://www.bilibili.com/video/BV1kw3Lz4EVY) 3.通义万相有官网的,但是是海外版(跟 chat.qwen.ai 同类):wan.video(通义万相官网),能生成图片和视频,基本上所有通义万相的功能都在这里了(讲到的全免费无限制): 文生视频、图生视频、特效、首尾帧、视频参考、重画(Repaint)、填补(Inpaint) Wan2.2 Plus 和 Wan2.1 Plus 都可使用 5种万相文生图模型 加速生成、优化提示词、音效生成(别再说万相没音效了) 还有社区 并且普通速度无限制使用,加速模式每天一次(开会员能提升次数) 这次的发布其实提升很大,实力非常强,甚至开源了,所以老外也都给了很高的评价

♥ 8 ↩ 1

林林林云 2025-07-28

功能这么强,为什么不像友商那样做一个可以付费的,好用的视频体验官网.....

♥ 8 ↩ 26

CODM策划老王I958 2025-07-29

通义这么好,为什么就比不过deepseek和豆包呢

♥ 7 ↩ 3

彧弟 2025-07-28

vace啥时候有,非常需要这个[打call]

♥ 7 ↩ 2

霜落世明 2025-07-29

开源Wan岁[打call]

♥ 6

难猜的用户 2025-07-28

1.Wan 2.2 系列也发布了图片生成模型(图1) 2.Wan 系列以前就有音效生成了(图2,链接:https://www.bilibili.com/video/BV1kw3Lz4EVY) 3.通义万相有官网的,但是是海外版(跟 chat.qwen.ai 同类):wan.video(通义万相官网),能生成图片和视频,基本上所有通义万相的功能都在这里了(讲到的全免费无限制): 文生视频、图生视频、特效、首尾帧、视频参考、重画(Repaint)、填补(Inpaint) Wan2.2 Plus 和 Wan2.1 Plus 都可使用 5种万相文生图模型 加速生成、优化提示词、音效生成(别再说万相没音效了) 还有社区 并且普通速度无限制使用,加速模式每天一次(开会员能提升次数) 这次的发布其实提升很大,实力非常强,甚至开源了,所以老外也都给了很高的评价

♥ 6 ↩ 2

Earthquakes地震 2025-07-28

更好的Wan!更好地玩!😄

♥ 6

天呢au 2025-07-29

真是源神呐,一波又一波开源

♥ 5

上班下班宿舍 2025-07-28

像可灵一样出个在线跑软件吧[doge][doge][doge]

♥ 5 ↩ 2

虾点赞 2025-07-29

还是5秒真男人

♥ 4 ↩ 1

不见朱颜泪 2025-07-28

能超越可灵1.6吗[脱单doge]

♥ 4 ↩ 14

集妮腻尼 2025-07-28

牛,坐等vace发布[保佑]

♥ 4

赛博浮云 2025-07-28

运镜能读懂左右了?

♥ 4 ↩ 1

红云纭 2025-07-29

这条视频也是ai生成的吗[doge]

♥ 3

山里毛哥 2025-07-29

全是老外镜头。服了。难道底膜是阿三的不成?[笑哭][笑哭]

♥ 3 ↩ 1

怀零柒肆伍0745 2025-07-28

nice.[打call][打call][打call][打call][打call]

♥ 3