Sora真的能理解因果吗?用人人都懂的语言告诉你OpenAI做对了什么?
合集 · 奇点临近了吗?——B站最深入浅出的人工智能科普 (29)
-
【视觉起源】先有眼睛还是先有脑子?几十亿年的生命演化正在揭示AI爆发的秘密
18:46
-
坐高铁时,你从未察觉的 5 重生命保障,每道都是高科技
21:54
-
手把手带你推出蝴蝶效应后,你会发现你对混沌的理解都是错的
25:22
-
这种比黄金还贵的金属是如何被人类征服的?如今中国的产量已经独霸全球
20:38
-
赛博、自动机器、控制论——20世纪最伟大的科学构想,最终会带来工业乌托邦吗?
23:55
-
垃圾造的水泥靠谱吗?20分钟揭秘城市垃圾循环的真相
22:53
-
大模型、SLAM、空间智能——人形机器人离进入家庭还有多远?
24:11
-
是什么打败了波士顿动力?液压vs电驱——20分钟看透人形机器人硬件变革
22:19
-
百万美元不如一套算法?研究了32篇论文,我搞懂了机器人运动背后的秘密【具身智能第2期】
35:10
-
未来革命or资本泡沫——研发投入50年,人形机器人突破了什么?
25:02
-
DeepSeek是从0到1的创新吗?是。万字揭秘DeepSeek R1底层原理
27:01
-
半个月前,中国科学家发现16万种新病毒,这意味着什么?
22:42
-
到底什么是工业大模型?一手资料,全网最硬核解读工业大模型的实现细节
24:18
-
AI风头已过?还是正在悄悄改变世界?一年半了,大模型改变了哪些行业?
21:49
-
信息茧房?平台造神?来聊聊算法对人类社会的影响
26:14
-
未必,AI正在引发科学革命,可控核聚变、启发科学直觉、模拟大分子...【人工智能系列视频】
20:48
-
Sora真的能理解因果吗?用人人都懂的语言告诉你OpenAI做对了什么?
20:26
-
【年终总结】我们测评了10款国产AI大模型,结果大跌眼镜
21:44
-
当你有20万字的内容要AI读的时候,在座的各位都是...——全站最深入的大模型长文本能力解读
20:26
-
用初中数学讲透人工智能原理
20:50
-
神经网络是如何一统天下的?
19:54
-
卷积神经网络是什么?AI会毁灭人类吗?
17:43
-
chatGPT的祖宗——词向量和transformer
23:32
-
你真的弄懂chatGPT了吗?全网最深入浅出的chatGPT原理科普,包你看懂
18:06
-
万字解析 | 为什么说GPT不会产生意识?它对我们有多危险?【chatGPT科普(下)】
23:24
-
ChatGPT背后的大模型训练
14:24
-
用100道有毒的问题,就能调教出一个更有善意的AI?【人工智能系列(番外篇)】
16:38
-
AI是如何作画和修复老电影的?10分钟还你一个4K的青春。【AI原理解析系列】
16:03
-
AI自我意识觉醒?15分钟告诉你AI智能体真相
15:07
Description
Sora是如何理解世界的?为什么Sora能够做出远超过其他视频AI的效果,除了堆算力,Sora做对了什么?我们用通俗易懂的语言与大家聊一聊Sora的底层原理,让你看看Sora的时间一致性和因果逻辑性来自哪里。
Comments
真宝藏up主,干货无敌多,能跟得上时代做前沿科普的没几个[喜欢]
♥ 159 ↩ 5
和ai手机比起来,我觉得ai最需要造福人类的是在医药和科学领域用它强大的算力开发出治愈心血管和癌症的药物,科学领域比如材料学开发新的电池和超导体。
♥ 151 ↩ 21
UP说的很好,但扩散模型的幻觉即使是Sora也没有解决,而这个问题只有"稳定解决的跨时代模型"和"没能解决的垃圾模型"两个结果,目前Sora只是非常棒的垃圾.但它证明AI是一个非常重要的发展方向,一个全新的人类时代可能真的快来了
♥ 122 ↩ 10
Sora最逆天的事他要融资8万亿美元[笑哭][笑哭][笑哭]
♥ 62 ↩ 9
有幸看过sora生成的视频,有出现过人撞墙消失的画面[笑哭]似乎它无法理解转弯和撞墙的区别
♥ 50 ↩ 3
这么说来,ai是运用现有的模型,然后计算概率,把概率最大的结果套入模型了,最后得出结果。 人的思考也有这个过程,但人会使用物理规律来参与思考,并且会运用逻辑推理来进行修正,这才是【真正理解事物】,而ai还是停留在【模仿】
♥ 39 ↩ 18
sora的训练集,是二维图片,长度4秒。 所以上限就在这了。 如果想理解世界 需要一个传感器系统,能感受物理世界的力(不一定是手) 多复合眼睛的摄像系统能校验空间位置的眼睛。 还有声音采集系统。 这三者集合训练。 应该才能生产出认知绝大多数准确的模型。 时长也得超过2小时
♥ 37 ↩ 3
up是有一个团队吗,视频真的很优质。
♥ 35 ↩ 7
ai理解了世界,但不是用人类理解世界的方式。
♥ 33 ↩ 6
和预想的差不多嘛。Sora越强调图像处理,模型就越偏科,以后更可能变成专业AI而不是通用AI。我想最后人类还是得自己把世界编译好再交给计算机,没法偷懒。
♥ 29 ↩ 1
🔥课代表总结🔍: 视频主要探讨了SARA(可能是指Sora)如何理解和生成视频,以及OpenAI在这一领域的创新。SARA通过一种名为patches的数据分割方法,将时空信息整合到AI模型中,利用扩散模型理解时间连续性和逻辑一致性。视频生成不再是逐帧操作,而是通过Transformer网络处理时空关系,生成流畅的视频内容。 OpenAI的贡献在于将Transformer技术应用到视频生成,解决了时序信息处理的问题,使得视频AI如SORA能够生成更自然、符合逻辑的视频。虽然SORA的技术并非全新发明,但OpenAI通过巧妙应用现有技术,创造出令人印象深刻的产品。 OPPO的AI手机战略展示了未来手机将如何集成自主学习、生成能力、感知世界的功能,强调本地计算资源的重要性。OPPO通过多方面的努力,包括AI模型、硬件升级和生态系统的构建,预示着AI手机的未来发展趋势。 视频最后提到,创新并不总是关于全新的技术,而是如何整合和优化已有元素。SARA和OPPO的故事提醒我们,成功的关键在于战略眼光、资源整合和工程实力的结合。 --本消息由@AI视频总结 召唤成功
♥ 20
可你之前说是vivo的最强 最近几期实在内容变薄了,却越来越丝滑了,
♥ 17 ↩ 4
总有人评论,这东西对生产力意义不大。几百年前,笛卡尔、伽利略、牛顿在搞物理数学的时候,也有人说“你研究这玩意对种地意义不大”
♥ 16 ↩ 6
当有人在拿着放大镜给Sora挑刺的时候 我们在忙着让AI学习给领导敬酒
♥ 14 ↩ 5
只有集成物理引擎才有肯能实现AI世界模型
♥ 14 ↩ 9
本质上不存在思维或理解,更类似于利用算力穷举,强行模拟
♥ 14 ↩ 10
Sora(そら)-穹(妹)[滑稽]
♥ 13 ↩ 6
sora做得好吗,现在来看已经很好了 但是我不觉做得很对,现在的AI技术依旧是穷举和猜测,以及进一步消耗更高算力(及能源)的猜测和穷举。确实这种模式已经开始在一些领域发光发热了,可这本质上也只是另一次高算力机器代替算盘的迭代,真正意义的人工智能还在某个胚芽里等待唤醒它的“父母”,比如等待着脑科学的突破
♥ 12 ↩ 3
我们能不能用制作动画的手法,把主角、配角、物品、背景分开来绘制,减少相互干扰的发生。 然后再叠在一起成片?
♥ 11 ↩ 5