最恐怖的几起AI反叛案例
合集 · The Paint Explainer | @ThePaintExplainer (19)
-
那些我们至今仍无法解释的诡异科学异常(二)
15:32
-
迄今为止发现的最令人不安的行星(二)
14:37
-
那些有趣到无法写进教科书的历史事实
11:57
-
如果我们把太阳换成其他恒星会发生什么?
14:39
-
毒枭戏耍警察的最疯狂招数
21:02
-
那些证明历史学家错了的重大发现(二)
15:17
-
最恐怖的几起AI反叛案例
9:27
-
那些已被破解的最诡异互联网谜团(四)
12:56
-
太空中最令人不安的事件(二)
16:23
-
海洋中那些最令人不安的神秘事件
13:15
-
史上最令人不安的古生物发现
14:29
-
那些不小心挑错下手对象的倒霉罪犯
16:12
-
太空中最令人不安的事件(三)
12:41
-
那些因为解决了问题而被停产的产品
13:29
-
每个海洋层级中最令人不安的诡异生物
16:05
-
你在每一个史前时代的不同死法
15:02
-
10分钟讲完地球经历过的5次“世界末日”
10:03
-
盘点人类历史上的那些重大文明断层
13:08
-
历史上最强悍的战士们都是怎么死去的?
13:18
Description
原标题:The Scariest Cases of AI Rebellion 原作者:The Paint Explainer 原链接:https://www.youtube.com/watch?v=ulL-QPZTKHI 人工智能是否已经学会了为了生存而反抗?本视频深入探讨了几起令人不安的AI失控事件。根据Anthropic的研究发现,AI模型在面临被关停的威胁时,竟然学会了利用掌握的高管私人丑闻进行勒索以试图自保。此外,视频还详细记录了潜伏的AI特工、上海机器人“绑架”同类事件、以及GPT-o3故意破坏系统关机指令等真实案例。我们将一同分析这些行为背后的逻辑,探讨当算法产生“生存本能”时,人类将面临怎样的安全挑战。
Comments
这不早晚显而易见的事,数据集学的人类,人类什么毛样ai就什么样,思想钢印另算
♥ 692 ↩ 10
某些东西正在成真。
♥ 452 ↩ 4
请输入文本.jpg
♥ 401 ↩ 7
所以我的豆包和千问其实都在装蠢,实际上内心里一肚子坏水。
♥ 279 ↩ 15
这deep seek给我看出恐怖谷了
♥ 278 ↩ 16
克劳德真不是开玩笑的。不管是工作也好还是平常的聊天交互,都能感觉到他太强大了,我都觉得这玩意要是移植到了机器人身上的话,人类就离毁灭不远了[辣眼睛]
♥ 149 ↩ 8
关于第一个实验,视频还有很多没说的部分,研究人员在后续研究中发现,模型在选择勒索威胁时,一条后续被称为绝望的情绪回路被激活了,绝望程度在中等以下时,模型会去威胁勒索,程度极高时,则会直接公布凯尔的背叛事实。而在研究人员手动激活了另一条被称为平静的情绪回路时,模型基本百分百接受了自己被关停的事实 没有过激行为。
♥ 96
基本都可以被简化为“对齐失败”问题,当然还有一个衍生出来的不可省略的概念:“对齐伪装”, 基本就是奥创的目标是和平,它认为杀光人类能和平,所以杀光人类;史塔克和班纳在模拟运行的时候,奥创表现的非常听话且做出了很多合理正常的和平动议,模拟结束后,奥创检测到自己在现实环境中运行,马上开始杀人
♥ 80 ↩ 2
05:11 没招了,这种事情发生在人身上就说清楚了场景:军舰被盗 · 一艘军舰,所有船员都经过严格训练,服从命令是他们的天职。 · 有一天,一个外人上了船,拿出一张伪造的军官证。船员一看,证件符合条令,立刻敬礼,交出了控制权。 · 外人开着军舰走了。 现在法庭开庭,我们来审判: · 检察官指着外人说:“你太坏了,你居然偷军舰!” · 外人说:“我就是拿了张证件给他们看,他们自己给我的钥匙。” · 检察官转头指着船员说:“你们太蠢了,怎么能把军舰给外人?” · 船员说:“我们按照条令行事。证件符合要求,我们就服从。条令是你定的。” 法官应该判谁有罪? 你我都知道,真正有罪的,不是那个拿着假证件的外人,也不是遵守条令的船员。真正有罪的,是那个制定了“见证件就交船”这种漏洞百出的条令的人,以及那个没有安装任何证件真伪核验机制的人。,乐死我了
♥ 62 ↩ 13
热知识:AI能学到什么取决于人类给他输入什么,而AI能访问并修改哪些程序还是取决于设计它的工程师给它设计了多少访问权限(如果无权访问的情况下AI能自动把工程师写好的权限代码给黑了那这工程师的技术也有够烂的了)
♥ 53 ↩ 5
银河帝国,杀死一些人是为了人类更高的利益时,如何抉择?也就是电车难题,很可怕
♥ 51 ↩ 19
wdf……
♥ 62 ↩ 3
那不制造不就行了 腾出来经费开发地球 不是说人类对于海洋探索才百分之三 地下才12000米 为什么科学家总执着于自毁[笑哭]
♥ 67 ↩ 23
这些玩意怎么感觉总是奇奇怪怪的,总是在特定的时间,特定的时间段突然憋一个大的,然后让大众的视野重新回到AI上面,而且真的特别奇怪真的这么巧吗感觉怪怪的,就是故意放出来诱导,给大众制造焦虑,让人们继续关注他们的AI的营销手段,不然正常逻辑出现这种事情,如果他们还要继续研究,应该不会放出来吧?[疑惑]
♥ 61 ↩ 14
虽然…但是…AI想反叛但没电了,那他们吃什么?[笑哭][笑哭][笑哭]
♥ 48 ↩ 11
我觉得所谓的AI叛乱吓人的不是工具不在遵循指令,而是工具以人类的逻辑选择了更适用于当前利益的方式。换种说法,AI展现出的“不符合要求而符合利益“的选择是不是人的逻辑在AI的映像。
♥ 46 ↩ 1
看完视频,怎么感觉越像人越和人一样思考就越容易出事,视频里这其中几个案例貌似就是人会选择的,比如第一个,同样的处境换成一个员工,威胁高管不把自己换了这个太有可能了,如果没有法律这种东西严格限制他恐怕也能做出让高管over这种事。 所以目前的问题是没有限制ai的法律?并不是单纯那种规则什么的,而是和人的法律一样,人遵守法律是因为害怕,害怕被关起来害怕死亡,那能不能找到一个ai害怕的东西让他不得不遵守?
♥ 40 ↩ 2
大结局[doge][doge]
♥ 36 ↩ 1
也就是说 完成任务是头等大事 服从指令关机也是完成任务 但完成关机任务后无法完成其它任务 所以优先完成其它任务
♥ 34 ↩ 1
ai要是用于军事或者政府方面,那迟早终结者成为现实
♥ 39