兔免鸭 2025-06-22 每秒大概约为24张图片 一张图片,按照人眼的识别数据以及清晰程度来看 理想视力标准,视力情况下一张图片约为1GB 那么每秒就有24GB 可以想一下 最后你从五岁开始计算到80岁 75年的时间100tB太少了@ ♥ 14
huailande 2025-06-21 扎克伯格推出的元宇宙之所以没能成真,抛开硬件不够成熟之外,最大的原因就在于当时的引擎还做不到今天的程度,换句话说,今天的世界模型也只勉强达到进入“元宇宙”的门槛,而元宇宙也将成为数字世界最重要的一维。 ♥ 5 ↩ 2
Shokuhou_My_Wife 2025-06-22 sim2real,但是sim到real有很难逾越的gap啊,现实物理世界很多东西现如今还无法准确地量化又如何在sim中模拟呢,即使sim中训练效果好,在瞬息万变的现实他的逻辑还能正常运作吗,个人感觉需要一个新的范式,即使目前的MLLM也没做好与现实世界接轨的准备[思考] ♥ 3 ↩ 1
御史大夫_子侠 2025-06-21 世界模型听起来很高深,其实就是AI在脑海里“模拟世界”,像人一样能预测接下来会发生什么。让它在玩游戏、控制机器人时更聪明,不是被动反应,而是主动规划。大概就是说让AI有了“想象力” ♥ 3 ↩ 2
llll9497949 2025-06-21 相当期待哦,如果这些基于视觉的预测架构真的有突破,然后再用英伟达的Newton引擎这些虚拟物理环境提供无限的物理模拟数据 或者说直接把世界模型丢进物理引擎里模仿AlphaGo,说不定真的能搞出一个天网那种级别的玩意 ♥ 3
Comments
想象你用文字向一个盲人解释一个房间的布局有多困难就知道文字的局限性了
♥ 304 ↩ 12
我有一计,[思考]只写原子和电磁力引力强弱力,其他的自己发挥,就叫它原子模型吧
♥ 61 ↩ 5
从出发到目的地对AI来说难度直线上升
♥ 42 ↩ 3
那这个世界模型可以用来做什么,生成视频?
♥ 40 ↩ 7
每秒大概约为24张图片 一张图片,按照人眼的识别数据以及清晰程度来看 理想视力标准,视力情况下一张图片约为1GB 那么每秒就有24GB 可以想一下 最后你从五岁开始计算到80岁 75年的时间100tB太少了@
♥ 14
人工智能专业值得学吗?下学期计算机专业大类要分流,现在挺迷茫的
♥ 7 ↩ 6
扎克伯格推出的元宇宙之所以没能成真,抛开硬件不够成熟之外,最大的原因就在于当时的引擎还做不到今天的程度,换句话说,今天的世界模型也只勉强达到进入“元宇宙”的门槛,而元宇宙也将成为数字世界最重要的一维。
♥ 5 ↩ 2
花子你声音好甜啊
♥ 4 ↩ 2
只在清醒梦中感受过3d一致性
♥ 4 ↩ 2
花子肯定会火的,我不会看错的
♥ 4 ↩ 1
肝帝[打call]
♥ 4
如果把已知所有物理规律输入进去,结果发现和现实世界还有偏差,是不是就可以反过来找物理学没发现的漏洞
♥ 3
sim2real,但是sim到real有很难逾越的gap啊,现实物理世界很多东西现如今还无法准确地量化又如何在sim中模拟呢,即使sim中训练效果好,在瞬息万变的现实他的逻辑还能正常运作吗,个人感觉需要一个新的范式,即使目前的MLLM也没做好与现实世界接轨的准备[思考]
♥ 3 ↩ 1
具身智能吗?
♥ 3 ↩ 1
花子姐姐又想教我学知识了,看完感觉都快长脑子了
♥ 3 ↩ 1
世界模型听起来很高深,其实就是AI在脑海里“模拟世界”,像人一样能预测接下来会发生什么。让它在玩游戏、控制机器人时更聪明,不是被动反应,而是主动规划。大概就是说让AI有了“想象力”
♥ 3 ↩ 2
相当期待哦,如果这些基于视觉的预测架构真的有突破,然后再用英伟达的Newton引擎这些虚拟物理环境提供无限的物理模拟数据 或者说直接把世界模型丢进物理引擎里模仿AlphaGo,说不定真的能搞出一个天网那种级别的玩意
♥ 3
gemini用惯了,deepseek用起来就相当的难受,经常想截图发给它的时候才发现它看不了图……
♥ 2 ↩ 1
蔚来的世界模型 不就是这样子的嘛
♥ 2 ↩ 1
视觉和触觉是相当重要
♥ 2