12dora 2026-04-02 glm5.1每天下午大概10token/s,等glm20k输出完的功夫codex已经200k输出完了,只有上午和晚上的非高峰时段能用用 而且5.1特别喜欢读一个文件后thinking一堆内容再去explore文件,而不是codex那样读几个相关文件再开始思考 导致一些小需求体感上codex舒服很多 ♥ 119 ↩ 20
TW小姬 2026-04-07 glm5.1我是用國際版的,應有5.3codex opus4.6約40~50%的能力。速度約4~5分之1,比較複雜的任務很容易做錯,常常一件事要多次規劃才往目標靠攏。我的體感是claude是100分的話 codex有90分 gemini有75分,glm約50分,minimax2.7我也是國際版的,也是需要非常多次提示詞,我感覺比glm5.1更多提示才能往目標方向,但速度比glm5.1快很多,opencode go我用過kimi2.5我不確定是否量化過,因為我都只做後端,不做前端,而且影視相關軟件的規劃,我覺得還是codex opus能夠順利分拆任務,同樣的任務,glm做到第4天,明顯開始偏離SPEC....需要另一llm來監工... ♥ 108 ↩ 41
没名字你帮我取一个吧 2026-04-09 各位记住一件事,模型的智力和能力固然重要,但是不要忽略了Agent框架本身、Skills、插件、工具还有提示词这些实际上更重要的外部条件 我用了几个月的ClaudeCode和OpenCode,用过Claude的模型和国产的模型,这是我最大的感触 ♥ 43 ↩ 11
bobcy2012 2026-04-02 感觉智谱的coding plan lite套餐的次数严重缩水,其他家50元档左右的coding plan套餐,每5小时至少能让用户使用400次甚至更多,而智谱的lite套餐居然只有80次。用cc或opencode接入的话,只开一个主Agent编程估计80次不到1小时就用完了,只有买智谱的pro套餐才能撑的起1个人当主力编程agent使用。如果想开sub-agent的话pro估计也会碰到限速,只能选max套餐。 ♥ 43 ↩ 7
熊猫长得像钢琴 2026-04-02 对我这种初学者感觉最便宜且比较稳定的就是minimax的codingplan,2.7也有所进步,小龙虾玩玩可以,轻度生产力也比我想象中好,主要是价格美丽🤣 ♥ 29 ↩ 19
青空之主宰 2026-04-02 glm5 设计架构的能力太差了,做个云相册设计的流程简直一言难尽,还得我自己来,讲清楚了也不行,生成出来不一致的代码,重复方法,干脆直接就有严重错误逻辑,写个网页播放实况照片都写不明白,去年的 claude3.5 sonnet 面对这种问题真是随便出前端代码都不带出问题的 ♥ 14 ↩ 3
YYDDBZG 2026-04-02 小任务可能可以,复杂任务根本顶不了,我处理一个计算图形学相关的问题。glm5.1和mm2.7我改了好几天(非量化版,都是原厂的coding plan)都没改好,codex一下改好了,cc更不用说了[吃瓜] ♥ 13 ↩ 6
amu134 2026-04-07 这个评测觉得有广告推广成分吗?同样处理泛化的内容不管是速度还是逻辑思维都有很大差距好吧。国内模型数据对比图大部分都是特定训练后的修正数据给出的数据对比图,参考价值极低。不然国内很多模型数据图都超越顶尖模型为什么评价却很拉胯 ♥ 12 ↩ 3
Comments
glm5.1每天下午大概10token/s,等glm20k输出完的功夫codex已经200k输出完了,只有上午和晚上的非高峰时段能用用 而且5.1特别喜欢读一个文件后thinking一堆内容再去explore文件,而不是codex那样读几个相关文件再开始思考 导致一些小需求体感上codex舒服很多
♥ 119 ↩ 20
glm5.1我是用國際版的,應有5.3codex opus4.6約40~50%的能力。速度約4~5分之1,比較複雜的任務很容易做錯,常常一件事要多次規劃才往目標靠攏。我的體感是claude是100分的話 codex有90分 gemini有75分,glm約50分,minimax2.7我也是國際版的,也是需要非常多次提示詞,我感覺比glm5.1更多提示才能往目標方向,但速度比glm5.1快很多,opencode go我用過kimi2.5我不確定是否量化過,因為我都只做後端,不做前端,而且影視相關軟件的規劃,我覺得還是codex opus能夠順利分拆任務,同樣的任務,glm做到第4天,明顯開始偏離SPEC....需要另一llm來監工...
♥ 108 ↩ 41
替代不了一点 长上下文发疯 老用户都经历过了 偷着降额度 超售 限制并发 都是智谱干的
♥ 51 ↩ 3
各位记住一件事,模型的智力和能力固然重要,但是不要忽略了Agent框架本身、Skills、插件、工具还有提示词这些实际上更重要的外部条件 我用了几个月的ClaudeCode和OpenCode,用过Claude的模型和国产的模型,这是我最大的感触
♥ 43 ↩ 11
感觉智谱的coding plan lite套餐的次数严重缩水,其他家50元档左右的coding plan套餐,每5小时至少能让用户使用400次甚至更多,而智谱的lite套餐居然只有80次。用cc或opencode接入的话,只开一个主Agent编程估计80次不到1小时就用完了,只有买智谱的pro套餐才能撑的起1个人当主力编程agent使用。如果想开sub-agent的话pro估计也会碰到限速,只能选max套餐。
♥ 43 ↩ 7
都是广子罢了,opus4.6谁用谁知道。
♥ 41 ↩ 23
我感觉glm-5.1还是很爽的,价格便宜(我这之前买了旧版coding plan)的前提下效果也不错,让它自动化打包+测试也都能够搞定
♥ 29 ↩ 6
对我这种初学者感觉最便宜且比较稳定的就是minimax的codingplan,2.7也有所进步,小龙虾玩玩可以,轻度生产力也比我想象中好,主要是价格美丽🤣
♥ 29 ↩ 19
不用看都是广子,5.1如果好用根本不用广,天下苦4.6久矣,各种封号各种限制。
♥ 24
glm5 设计架构的能力太差了,做个云相册设计的流程简直一言难尽,还得我自己来,讲清楚了也不行,生成出来不一致的代码,重复方法,干脆直接就有严重错误逻辑,写个网页播放实况照片都写不明白,去年的 claude3.5 sonnet 面对这种问题真是随便出前端代码都不带出问题的
♥ 14 ↩ 3
我开阿里的 coding plan 一个多月,每个模型都试了,最后还是一直使用 glm 5
♥ 13 ↩ 7
小任务可能可以,复杂任务根本顶不了,我处理一个计算图形学相关的问题。glm5.1和mm2.7我改了好几天(非量化版,都是原厂的coding plan)都没改好,codex一下改好了,cc更不用说了[吃瓜]
♥ 13 ↩ 6
不能,我的项目之前Claude4.6opus做的好好得,实在没钱了换glm5.1试试,第一次改动就把项目改崩了,我是真绷不住,还好可以回滚
♥ 12 ↩ 7
这个评测觉得有广告推广成分吗?同样处理泛化的内容不管是速度还是逻辑思维都有很大差距好吧。国内模型数据对比图大部分都是特定训练后的修正数据给出的数据对比图,参考价值极低。不然国内很多模型数据图都超越顶尖模型为什么评价却很拉胯
♥ 12 ↩ 3
5.1国产第一没毛病,但是替代sonnet都做不到,实测!
♥ 10
为什么国内一直搞不出1M的上下文,是因为算力被卡了吗
♥ 8 ↩ 24
从glm4.6开始吧,就有up说对标opus4.6,现在5.1了还是。是glm没进步呢,还是之前虚假宣传呢
♥ 7 ↩ 8
太难抢,会T人,直接用阿里的qwen3.6了
♥ 6 ↩ 1
怎么抢呀 ,感觉国产模型里面最好的一个了
♥ 5 ↩ 4
学粒子物理的压根就没有ai能写出他的仿真
♥ 5 ↩ 4