微软多模态模型visual-chatgpt实测 | 谷歌PaLM-E模型 | chatgpt4.0

合集 · 各式各样的AI应用 (124)

  1. 1:49
    第一人称AI视频制作教程来了!
  2. 2:59
    手把手教你用AI制作动物跳水视频!
  3. 2:56
    用AI生成爆款ASMR视频?提示词就要这样写!
  4. 4:51
    Flux3多模态模型实测效果展示 | 文生视频
  5. 9:09
    多模态大模型Flux3来了,BFL FLUX 3 全解读|Real World Models · 图/视频/音频/动作共骨干
  6. 8:53
    视频重拍技术!Vista4D 全解析|CVPR 2026 Highlight · 一段视频任意换镜头 · 13 段官方 demo
  7. 14:56
    DeepSeek-V4 深度解读|1.6T Pro + 284B Flash 同发|百万 token · 12 张跑分图一次看完
  8. 13:30
    GPT-5.5 全解析|OpenAI 最新最强模型 13 分钟看完 + 6 张可视化跑分图
  9. 12:47
    OpenAI 又一次 AI 图像革命|12 分钟看完 ChatGPT Images 2.0 | OpenAI 最新 gpt-image-2 全解
  10. 0:35
    【AI视频】AI视频新时代! 即梦Seedsance2.0实测视频
  11. 0:29
    【AI视频】Wan2.2-Animate发布!堪比动捕的视频模型!
  12. 1:12
    【AI视频】当AI切割原神道具 [AI ASMR]
  13. 0:36
    【AI视频】用AI生成动物跳水视频,效果会怎么样?
  14. 0:42
    【AI视频】用AI生成动物跳水视频,效果会怎么样?(第二弹)
  15. 1:29
    【AI视频】个人实测!超强的海螺AI动态效果展示!
  16. 0:55
    【AI视频】AI视频运动领域重大突破!海螺2 Hailuo 02AI视频模型震撼发布!
  17. 3:28
    【AI视频】PixVerse国内版-拍我AI正式上线,快来生成属于你的国风影视作品吧!
  18. 2:17
    【视频转绘】重磅发布!Luma AI发布了最新的Modify Video视频转换模型!
  19. 1:34
    【图像控制】重磅发布!FLUX发布了最新的Flux-Kontext图像控制模型!
  20. 2:32
    【AI视频】如何用一个AI同时搞定Live2D效果和大片级片段效果的AI视频生成
  21. 1:35
    【AI视频】Pika推出超火功能Pikadditions!可以让现有对象或角色无缝集融入到现有视频中
  22. 1:01
    【即梦3.0视频】分镜演示视频
  23. 2:15
    【AI工作流】AI绘画也能一键工作流了!
  24. 2:17
    【赛博春节工具包】可以一键生成春节海报,表情,写真,春联等等的AI新春工具包,为你的赛博春节增添电子年货吧!
  25. 1:03
    【AI动画】来试试在线免费的AI动画吧
  26. 2:48
    【AI自动出图】AI绘画在线自动生图流
  27. 5:33
    【AI文案/绘画/粗剪】当AI遇上剪辑(简单教程)
  28. 1:45
    【AI视频】Gen-1测试版使用教程与效果展示
  29. 4:38
    【AI做游戏素材】第一家AI生成游戏素材网站讲解
  30. 3:47
    【AI做PPT】用AI来自动创作PPT吧!
  31. 2:02
    【AI建模】用AI画图就能建模?还能做直接做骨骼动画?厉害了!
  32. 1:40
    【AI扩图】用Dall.E让NovelAI生成的二次元人物更完整吧!
  33. 1:01
    刚刚!OpenAI发布了两段视频疑似Sora2文生30s而且自带音频
  34. 0:27
    【AI视频】一个能生成动态文字的AI视频模型!通义万相文生视频2.1正式公测!
  35. 2:30
    【AI搜索】结合了chatgpt的必应搜索引擎初体验与内测申请
  36. 3:03
    【AI视频】最新AI视频技术介绍
  37. 2:06
    【多模态】微软多模态模型visual-chatgpt实测 | 谷歌PaLM-E模型 | chatgpt4.0
  38. 1:20
    【AI文本To视频】最新!国产文本到视频大模型发布(阿里达摩院)
  39. 1:15
    【AI文本To视频/视频To视频】支持文本到视频,Gen-2正式发布!
  40. 2:07
    【AI改图】AI只需拖拽就能一键改图,DragYourGAN前瞻
  41. 1:08
    【AI改图民间版】DragGAN民间版本实战演示
  42. 6:23
    【AI多模态】谷歌发布了一个强大的AI-Gemini(双子座AI)
  43. 0:57
    【AI视频】谷歌正式发布AI视频生成模型Veo
  44. 2:50
    【AI电影】Luma正式发布DreamMachine电影级别AI视频制作工具
  45. 0:36
    【AI电影】Luma正式发布关键帧动画功能!(dream-machine)
  46. 0:48
    【AI美术】根据背景图改变插入物体的风格-MagicInsert项目效果演示
  47. 2:24
    【AI视频】腾讯混元文生视频HunyuanVideo正式开源发布!
  48. 0:06
    【速报 | AI视频】PixVerse 3.5正式发布!(视频为自测1080p图生视频效果展示)
  49. 0:11
    【速报 | AI视频】可灵1.6正式发布!(视频为个人实际测试视频)
  50. 3:45
    【AI视频】🔥字节跳动发布OmniHuman黑科技!静态图片秒变"戏精":能说唱会跳舞,手势驱动无限可能
  51. 1:40
    【AI视频】🔥Meta又放大招!VideoJAM用AI颠覆运动类视频生成
  52. 2:30
    以防你没见过25秒一个的Sora2Pro极限国度游戏画面
  53. 3:21
    个人实测Sora2Pro 一次性生成25秒的视频!魂类游戏画面测试
  54. 1:16
    Sora2正式支持一次性生成25秒视频!含案例视频
  55. 2:21
    当战地6遇上Sora2会发生什么呢?
  56. 2:21
    以防你没见过Sora2的无畏契约游戏画面
  57. 2:21
    以防你没见过Sora2的饥荒游戏画面
  58. 3:49
    以防你没见过Sora2的恐怖游戏画面
  59. 4:40
    当战争雷霆遇上Sora2会发生什么呢?
  60. 2:41
    以防你没见过Sora2的白宫陷落
  61. 2:08
    以防你没见过Sora2的第一视角动物捕猎画面
  62. 4:51
    以防你没见过Sora2的和平精英画面
  63. 2:01
    以防你没见过Sora2的自拍视角奔跑画面
  64. 2:36
    极限运动但是Sora2生成
  65. 2:31
    当我用Sora2生成黑神话悟空游戏画面会如何?
  66. 1:51
    当我用Sora2生成舞蹈画面会如何?
  67. 3:01
    当我用Sora2生成王者荣耀游戏画面会如何?
  68. 2:41
    当我用Sora2生成我的世界游戏画面会如何?
  69. 2:49
    当我用Sora2生成音MAD混剪/鬼畜会如何?
  70. 2:57
    当我用Sora2生成原神游戏画面会如何?
  71. 1:41
    个人实测Sora2!短视频短剧测试!
  72. 2:21
    个人实测Sora2!CG动画打戏与游戏斗测试
  73. 4:33
    OpenAI正式发布Sora2!最全官方案例视频合集欣赏!
  74. 5:26
    不止文生视频!openai视频生成模型sora-视频编辑展示
  75. 5:40
    不止文生视频!openai视频生成模型sora-视频融合
  76. 0:44
    不止文生视频!openai视频生成模型sora-图转视频展示
  77. 0:41
    openai视频模型sora生成我的世界视频
  78. 18:01
    【你没见过的OpenaiSoraAI视频合集带中文字幕】openai视频生成模型sora-文生视频
  79. 3:16
    超震撼!OpenAI索拉Sora最新生成视频合集
  80. 3:36
    SORA被泄露!用户制作的视频展示!
  81. 1:27
    【AI山海经音乐】TungTungSahur
  82. 3:31
    【Suno4.5】《春天在哪里》AI版
  83. 3:00
    用AI生成《桃花源记》音乐会是什么效果?
  84. 3:10
    Suno根据节奏旋律生成音乐
  85. 5:03
    世界模拟器?快手发布可灵AI大模型 (带提示词)
  86. 1:38
    可灵AI大模型个人生成测试视频来了
  87. 1:07
    AI视频时代已至?最强AI视频震撼来袭!
  88. 0:41
    2.5D国风-AI舞曲来袭!让AI来跳一曲吧!
  89. 0:59
    可灵AI-游戏画面生成效果
  90. 0:34
    最新AI生成巨石强森吃石头
  91. 0:11
    我做了一个《沙滩奇遇UFO预告片》
  92. 0:30
    "一曲霓裳,醉梦红尘" 来一曲AI国风舞蹈[壁上观]
  93. 0:38
    新年倒计时,但是用AI制作
  94. 1:32
    可灵AI2.0正式发布!
  95. 9:03
    炸裂!Runway正式发布Gen-3视频大模型(全视频带中文提示词展示)
  96. 1:50
    Runway Gen-3 生成英文艺术字效果展示
  97. 2:53
    来见识一下这些奇特的生物吧!
  98. 0:32
    Runway视角控制演示
  99. 9:42
    阿里发布快乐牡蛎-happyoyster世界模型-带字幕全预览
  100. 3:44:21
    米哈游发布LPM 1.0大模型: 实时生成角色视频,让 AI 角色 "活着对话" 成为现实
  101. 2:13
    未来已至?亲自体验AI游戏,我的世界实时视频游戏,最后竟然世界崩坏?
  102. 7:22
    47个奇观全重置!拒绝PPT动画!文明7奇观动画AI重制版来了!
  103. 1:30
    不好!AI好像发现自己是假的了!
  104. 0:25
    谷歌veo3生成体操实测视频来了!
  105. 1:17
    【AI视频新突破】谷歌发布Veo3视频模型支持原生对话音频/背景音乐/音效生成
  106. 0:33
    用Veo2测试飞天视频生成,效果会怎么样?
  107. 2:01
    用AI生成游戏类视频,效果会怎么样?
  108. 1:05
    用AI生成怪物类视频,效果会怎么样?
  109. 2:01
    用AI生成奇思妙想类视频,效果会怎么样?
  110. 1:21
    [第二弹] 用AI生成动画,效果会怎么样?
  111. 1:37
    用AI生成动物类视频,效果会怎么样?
  112. 0:57
    用AI生成破坏类视频,效果会怎么样?
  113. 0:45
    用AI生成灾难画面,效果会怎么样?
  114. 0:57
    用AI生成美食从天而降,效果会怎么样?
  115. 1:45
    用AI生成影视级画面,效果会怎么样?
  116. 0:23
    没想到AI终于能生成万剑归宗视频了
  117. 1:29
    用AI生成不一样的我的世界,效果会怎么样?
  118. 0:40
    用AI生成动画,效果会怎么样?
  119. 0:57
    用AI生成格斗游戏视频效果会怎么样?
  120. 0:11
    用任天堂N64主机玩原神(
  121. 1:13
    不是,谷歌,你往训练素材里面加的东西有亿点多啊
  122. 0:38
    【Veo2个人提示词测试】谷歌Veo2圆我御剑飞行梦
  123. 11:21
    【81个视频纯享版展示】地表最强AI视频模型发布!谷歌veo2
  124. 2:11
    当我用GPT4o生图把表情转成3D画风
Description
微软visual-chatgpt开源项目:https://github.com/microsoft/visual-chatgpt
谷歌PaLM-E项目介绍:https://palm-e.github.io

Comments

会飞飞的长虫 2023-03-12

这篇论文实际上没什么学术价值。 我一开始看到这个消息也并没有多兴奋,但是我看到源码后则是无语。 没有多兴奋是因为,CV在学术领域已经卷到头了。paperwithcode打榜,CV三大任务(分类,识别,分割)的前三名全都被MSRA给占据,下一步发展顶多是多模态方向走。我看到gpt能聊图片了,我以为是多模态。无语则是因为我以为是多模态嘛,微软独有gpt3的模型代码,然后加一些module做成多模态,训练出来一个能聊天能理解图片的模型。结果一看代码,1.用的是stable diffusion 2.用的是controlnet 3.用的是openai api。SD和controlnet是本地部署。这不就是用SD和controlnet理解图片生成类prompt然后修饰修饰发给chatgpt,然后gpt想要生成图片就把prompt发给本地生成么。 论文里大谈特谈VFM(visual foundation models),结果就是个这。。 没有什么学术价值,不过就是MSRA这几个人玩SD和controlnet玩的比较熟。坐拥大量的gpu资源,工程上和chatgpt集成了一下。 这十几个SD和controlnet的功能加一起需要70G的VRAM,单卡目前只有nvidia tesla A100和amd instinct MI250x能跑,多卡至少需要3~4张4090 如果有这么多钱买卡,属于是我上我也行了

♥ 22 ↩ 4

CSZzZzZl 2023-03-12

所以下周的4.0不会就这吧???

♥ 5 ↩ 2

未尽_L 2023-03-19

需要gmail的滴滴,代订plus,代充api,depay余额

♥ 1

查特查特 2023-03-12

总结(来自于AI智能chatgpt,chatgpt问题请见动态) 微软的visual-chatgpt是一个多模态的对话生成模型,谷歌的PaLM-E是一个面向自然语言处理的语言模型。 亮点 🤖 visual-chatgpt是微软开源的多模态对话生成模型。 🌐 PaLM-E是谷歌的语言模型,专注于自然语言处理。 📚 visual-chatgpt的GitHub链接为https://github.com/microsoft/visual-chatgpt。 📖 PaLM-E的项目介绍可在https://palm-e.github.io找到。 🤝 visual-chatgpt和PaLM-E都是开源项目。 💻 visual-chatgpt和PaLM-E都可以用于自然语言处理任务。 🚀 visual-chatgpt和PaLM-E都是当前最先进的模型之一。

♥ 1

b2li_PTsy 2023-03-12

[脱单doge][打call]

♥ 1

风吟Chenkin 2023-03-12

好耶,我刚刚发到这条新闻up就发视频了,及时雨[打call]

♥ 1

虎皮斑纹的猫 2023-03-12

好耶[脱单doge]

♥ 1

睿鏖 2023-03-21

实体机器部署成功,rtx 3080阉割模型

侧颜还是很美 2023-03-14

看了看作者开源的代码,还是没搞懂他的prompt是怎么实现的

萧煜明 2023-03-12

这个配音真实得像是普通话不标准的理科生up[辣眼睛]

给我也整一個 2023-03-12

未来可期

秋啊八 2023-03-12

cool

Ginggong 2023-03-12

cool