模型乱斗:智谱新模型GLM 5.2 对比 GPT 与 Claude 表现如何?

Comments

随意之城 2026-06-17

还好没用过fable,否则难以想象戒断反应有多痛苦[笑哭]

♥ 252 ↩ 49

就像外星人 2026-06-17

问一下博主测过fable之后会有戒断反应和倦怠吗。明知道有更聪明的模型在,现在的很多工作都不想做了,因为变成了替不够聪明的模型收拾烂摊子……

♥ 296 ↩ 21

毛绒团团子 2026-06-17

fable5和opus4.8合力打造的minecraft,耗时2小时,快回来吧fable真的有戒断反应了[大哭]

♥ 236 ↩ 30

离开家的海豚 2026-06-17

省流(个人体感): GPT5.5≈GLM5.2<Claude 感觉GLM5.2在部分情况下(比如小游戏)甚至会比codex上强一些(5.5降智太严重了)。但瘦死的骆驼比马大,GLM在全栈开发和基础的逻辑能力上还是没能赶上GPT。 GPT现在论编码不如Claude,论安全护栏和人情世故不如Gemini,卡在中间不上不下,也就价格和生图能打了。

♥ 169 ↩ 10

就像外星人 2026-06-17

是首次国产模型在代码层面正面和gpt最先进的模型的对决吗?

♥ 64 ↩ 63

丁达尔迅贤 2026-06-17

算牛的了,这玩意儿权重才 700B

♥ 55

Neuxiun 2026-06-19

GLM5.2单次思考做的,其实提示词写对了还是做的对的

♥ 47 ↩ 6

foreverSR 2026-06-17

还得是fable。抽其它的咳嗽[doge]

♥ 58 ↩ 1

他舅之为人民入坑 2026-06-17

都不算好看,本来就是见仁见智

♥ 57 ↩ 10

iSH0Wmeat 2026-06-17

国产的多模态能力全点给豆包了?还是豆包用自己的智商和其他国产模型做交易了

♥ 43 ↩ 5

织终 2026-06-17

glm我在方舟上49块买了一个月pro,我有点怀疑真的是我能买到的吗[哦呼][哦呼] 但实际还真是生效了,我运气有点好诶

♥ 47 ↩ 12

Red_JACK 2026-06-17

真正生产力环境下一般都不会纯Vibe Coding,会搭配plan模式文档规划执行的,那样效果会好很多

♥ 39 ↩ 3

猎奇点点点 2026-06-19

gpt和claude 智能水平都是high,但是glm是最高

♥ 30 ↩ 13

紙箱P 2026-06-17

gpt5.5真的降智很严重[笑哭]

♥ 27 ↩ 6

大师的星心吖 2026-06-17

你要这么说,我觉得估计真能打败现在的gpt5.5,因为gpt5.5在codex上下文只有不到270k,而glm5.2据说在1m内都有很强的记忆力,在真实agent环境中,非图像依赖的任务多半能吊打gpt

♥ 30 ↩ 32

毛绒团团子 2026-06-17

fable什么时候回来啊[大哭]

♥ 26 ↩ 6

icedrug123 2026-06-18

你最后的结论和你前面的测试结果有点左右脑互博了,前面测试明显是GPT 5.5和GLM 5.2差不多,然后最后结论突然变成了和顶级模型有差距,我都闹麻了,感觉你这结论就是典型的惯性思维,事实测试过程明显是clude独一档,gpt和glm就是坐一桌的不相上下

♥ 27 ↩ 7

悠岚岸 2026-06-17

克劳德感觉一直很强,或者说很稳,理解能力时刻在线,就是不给用,而且特别贵。要说缺点就是写前端或界面时自己的风格太强了,没有GPT和Gemini的样式丰富(?)除非自己追加提示词控制。GPT前后端也行,就是脑子经常出问题。GLM,我经常用,因为某字节的IDE支持拿时间换金钱,5-t以上大部分问题都能解决,解决不了的你无论怎么提示它都解决不了,死板的很。但胜在可以长期使用,也就是便宜[捂脸]

♥ 18

Summer907 2026-06-17

GLM真有点神了,只用了35K上下文就分析得挺透彻的,让他写个文档也会先去文件夹里翻以前GPT写的文档,照着它的格式去写。也是深得GPT本尊赏识了[doge_金箍]

♥ 17 ↩ 2

智慧明达的灯 2026-06-17

我前两天还在用cursor,主要使用composer2.5。今天看到GLM5.2上线API后就试着改了改我的一个项目。目前用下来并没有感到差异,甚至表现更好一点。用的语言是swift+GO。我打算过两天出个视频测一下模型能力以及直接调API会不会降智。各位可以提一些想测的题目,我看着测一下

♥ 16 ↩ 7