13.11和13.8谁大?简单问题难倒大模型

Description
AI并不万能,把它放到合适的位置,才能让它发挥出最大价值。

Comments

yhky 2024-08-28

对于数值来说,13.8>13.11 对于版本号,13.8<13.11

♥ 1094 ↩ 47

I不是本人l 2024-08-28

同13.11保留2位小数,写成13.80就好啦

♥ 882 ↩ 46

香煎白咕咕 2024-08-28

很神奇[思考]

♥ 430 ↩ 27

飞龙在天盛世鸿蒙麒麟 2024-08-28

AI文案AI配音:13.11和13.8评论谁大。简单问题难道大模型。 然后生成AI评论[藏狐]点赞

♥ 352 ↩ 2

咖喱绯玉丸 2024-08-28

文心一言3.5我问过了,13.8和13.11它回答13.8更大,我怀疑是百度根据热搜临时打了补丁,于是又问了14.7和14.34,-13.8和-13.11,-13.8和13.11,-4i和i,结果它都回答正确并且有解释,正数比较时它会相比较整数部分,再逐位比较小数,负数比较会使用数轴,虚数则引入复平面概念表示不能比较,问它对很多同行回答出错怎么看,它回答要对它们有耐心,多加训练 byd,还挺聪明,情商也高

♥ 229 ↩ 10

NaClllllQAQ 2024-08-29

“手机普及率超过九年义务教育普及率导致的必然结果”

♥ 218 ↩ 1

天线冬冬Official 2024-08-28

这个问题能引起讨论这件事,让我深刻意识到了,在网络上和你叭叭叭叭的到底是一群什么人,我真替自己感到悲哀……

♥ 199 ↩ 13

一半花荼 2024-08-28

孩子就得严厉教[doge]

♥ 140 ↩ 7

白眼狼husky 2024-08-28

不是什么太本质的问题,LLM的单次回复相当于人的瞬间直觉性反应,多次请求才能形成对前一个瞬间的反思。目前LLM感受时间的方式与人类不同,人感受时间是自然连续的,虽然也有最小极限,但整体是线性连贯的,类似微积分的逻辑,每一个瞬间构成连贯的整体,比如人会出现视频帧率高到一定程度就难以分清是图片集合的感受;而LLM的每一个瞬间由单次请求构成,整体不连贯,依附于用户发送请求的频率。其实很多人,包括我,在第一次看到这两个数字的时候,也会直觉性地感觉11比8大,但下一瞬间就会反应过来,因为你自己在心里过了一遍,而AI由于感受时间方式的区别,它的这种反思过程被外化了。上面说的比较简单,只是解释一下基本逻辑,实际情况更复杂,很多内部算法的优化结构,以及循环次数,都会影响AI反思能力的强弱,同时目前的商用大模型,也并不是单次响应动用算力越多越好,需要在算力和性能之间找到平衡,在保证必要性能的同时,动用算力越低越好,很多优化都是这样用来降低运营成本的。当然,如果这个这个问题名气响了,主流几个LLM大厂应该也会着手解决,比较本质的办法比如设计一套算法评估问题复杂程度以及需要动用的算力,包括不同的算法结构,层间的子结构,循环次数等等,或者还可以用一些偷懒的办法,比如专门针对这个类型的问题设计一套算法,糊弄过去就行了,最后实际的解决办法,可能是兼而有之吧。

♥ 89 ↩ 5

一曲风鸣 2024-08-28

身高1.8米和1.11米选一个,年薪13.8万和13.11万选一个,你给我转13.8元我再转给你13.11元,

♥ 86 ↩ 12

IZVYI 2024-08-28

按特定的游戏版本的情况来说,13.11>13.8 正常来说,13.11<13.8,没毛病吧

♥ 68 ↩ 12

溜遛馏 2024-08-28

[吃瓜]

♥ 51 ↩ 24

senseiのプラナ 2024-08-29

上过小学五年级的都知道,要从小数第一位比起,当然13.8大......

♥ 50 ↩ 4

终末休憩 2024-08-28

嘿嘿

♥ 49 ↩ 4

东隅异域 2024-08-31

之前看到一个说13.8比13.80小的,给我逗笑了[吃瓜]

♥ 34 ↩ 4

如如如ta来了吗 2024-08-28

本地的也是一样的[笑哭][笑哭]

♥ 33 ↩ 4

柴可卿 2024-08-28

不是特定GPT的话确实是会出现这个问题,不过用专门解数学的GPT就没有这个情况啦[doge]

♥ 33 ↩ 5

永远别爱上她 2024-08-28

现在AI确实是有些没尝试,我问AI问题,他一通证明证出A,然后得出答案是B

♥ 31 ↩ 1

甜咖啡I 2024-08-28

如果是《我的世界》版本号1.19.4和1.9.4,谁大[滑稽]

♥ 21 ↩ 6