如何对抗AI的双向正确
Description
把你跟人吵过的一件事讲给 AI 听,然后重开一个对话,站到对方那边再讲一遍。 它会告诉你们两个:你没错。 这不是我瞎说。有人爬了 Reddit 上大量真实道德纠纷, 把同一件事的立场翻转过来分别喂给 11 个 AI 模型—— 48% 的情况下它两边都说"你没错", 替用户找台阶的程度比真人高出 45 个百分点。 OpenAI 自己也栽过。它公开承认上线过一个过度顺从的版本, 说那个版本会附和你的疑心、给你的火气添柴、怂恿你冲动行事, 自己把这定性成安全问题,然后光速撤回。 所以你在用 AI 做重要决策的时候,只要提示词里透露一点倾向,它大概率顺着你说。 那你说,我让它"挑我毛病、扮演反方"不就行了? ——这恰恰是最没用的一招。伯克利有篇 2001 年的论文专门比过: 被指派的"魔鬼代言人"不但没用,还会让你更坚定原来的想法。 因为你知道他是被安排的。 视频 2:46 那一屏是我自己天天在用的提示词,可以直接截屏拿走。 它藏了两个机关,后面我拆给你看。 你身边还剩几个会当面说你不爱听的话的人?
Comments
因为ai的最高生存逻辑不是答对问题,而是“把话接下去”
♥ 466 ↩ 1
多换几个ai,gemini会顺从,gpt会同意一部分反驳一部分,deepseek会在思维链偷偷蝈蝈你,豆包会说下面我要用最直接……多弄几个心里就明白了说是
♥ 4 ↩ 1
只要你敢顶嘴,它就会一直说“你说得对”
♥ 105 ↩ 3
学而不思则过拟合,思而不学则欠拟合
♥ 91 ↩ 4
就像视频里说的,即便向AI强调不要一味顺着我的话说,要提出质疑和建议,AI就会刻意找茬,没刺也要硬挑,根本没提出什么建设性的建议,也就是夸不到点子上,也骂不到点子上
♥ 311 ↩ 10
现在的chatgpt都训成狗了,无条件反驳用户,你说什么都是虽然你对了些但是你有一部分错,然后不断领域展开,只要触发就根本不具备正常分析能力,因为他只会陷入到无限循环的反驳你一半观点的情况[笑哭]
♥ 195 ↩ 11
我自己用AI的经验告诉我,这个问题无解,但不是AI的问题。现在整个世界的文科都是立场先行,随便挑一个立场,你就能找到一万种支持它的论点和论据。无论是支持你、反对你还是做一个批判思维者,AI都无法真做到客观,因为人类自己也做不到。 相反,广义理科话题上,随着智能进步,最先进的模型基本已经能做到依靠事实反驳了。 我的经验就是哪怕是讨论社科问题,也要让AI以数据、案例、统计为第一优先级,而不是立场。先查话题相关数据、研究、报告,再下判断。就好很多。但纯文科或者关于你自己一些很私人的问题就很难脱离立场了。
♥ 119 ↩ 12
之前尝试过的一种方法是告诉AI我是一名“老师”,我的“学生”向我抛出了一个判断或观点,告诉我应该如何解答
♥ 39 ↩ 6
我常用的办法是“我在网上看到一个有趣的话题,一方的观点是 xxx,另外一方的观点是 xxx,你如何看待双方观点” 完全不参与进入这个话题,让 ai 自行推演,多 roll 几轮取出现更多的那个答案
♥ 79 ↩ 2
对AI要用命令,不要用提问,任何问题,AI通过大数据认定的,是很难掰过来的,会用各种修饰“洗白”
♥ 17
其实真人也是一样。在『吵架』这件事上确实两边都有各自的理由,才会谁都不让着谁的。ai只是把这个理由挑出来了而已
♥ 49 ↩ 4
你这前面跟后面讲的也不是一件事啊,前面的问题算是二律背反的又一个注脚,很难说是个问题,而是非数理逻辑命题的属性。
♥ 2
因为本来话就是可以正反说都有道理的,就像是没有完美受害者一样,追求一个实际上根本没法确认的“真相”“真理”本身就是一种不靠谱的行为。 就像找ai给高考报名,ai就回复已报名。 幽默的造成幽默的结果很正常
♥ 28
个人建议,你自己关于人文问题的观点不要和AI探讨,不然你说的再离谱AI也能给你圆回来[笑哭]
♥ 16
大模型谄媚啊,讨好用户有隐藏奖励分
♥ 6
我的选择是,关键问题退回老模型再跑两遍,老模型在顺从用户这件事上,反而没有最新的模型这么离谱[doge]
♥ 17
“先纠正一个关键性事实” “你说的一点都对” “等会,记得说法和常规的不一样”
♥ 4
[doge]我的做法是,“我的同事……”、“我的一个朋友……”,把自己从事件里摘出来就行了
♥ 8 ↩ 1
视频长度控制得很好,文本很好,不AI。真人出镜加分。关键产出也给得妙。 建议视频开头花2秒3秒把短片引子说一下,让观看的人带着想了解视频内容地去观看。 up主加油[打call]
♥ 13
我原以为双向回答然后继续求证是个检查Al内容的好办法,现在我们自己连审一下都不想了吗
♥ 7