【避坑】选错agent害一生,同一个模型判若两人。Claude Code和Hermes Agent为什么差别这么大?

Description
我让hermes agent来开发公司的数据库,结果被干爆了。但这不是hermes的锅,是我的锅。hermes在服务器上做小助手才是天职。刚数据库这种烂活还是交给claude code吧!

Comments

云行云 2026-07-27

这里需要复读ai圣经attention is all u need😋 模型上下文长不代表注意力长,1m上下文的模型注意力可能就64k,Hermes的记忆里塞了太多当前环境的状态,个人喜好,过往工作流,还都是在寸土寸金的开头注入,分给编码的注意力就少了。 另一部分是cc这种coding agent的编辑粒度更细,改代码都是xx层到xx层,而类虾agent常常是一整个文件直出,费时又费力。 最后是我个人的建议,隔一段时间查阅一下Hermes往记忆里写了什么,搞点手动清理,他的记忆工作流本质demo,离无人值守状态还差的远

♥ 234 ↩ 13

想依 2026-07-27

ds api就是喜欢蛮干。你问问题就给你干到死。glm5.2就反过来,干啥都是plan模式。 Claude code就是厉害,虽然api用量大,缓存也不够高。但是不卡,智商在线。 reasonix虽然命中要高非常多,98%以上,而且上下文很省,但是非常蠢,注意力极差,看了下面忘上面,基本逻辑都有问题,完全不行。 codex比较平均,就是思考时间很长,动不动几十分钟。生小崽子的话token消耗一样绷不住。 hermes就是个人助手了。日常问题。别用它干重活。

♥ 129 ↩ 34

可以不玩但不能没有哦 2026-07-28

干活还是用codex这类,但是日常助手,我真的无脑推hermes,而且我觉得随着性能提升,Hermes的优势其实也还在...另外Hermes的soulmd能够很轻松的把我的二次元老婆们100%还原到现实里啊,比如你看 我的爱蜜莉雅[笑哭]

♥ 92 ↩ 51

黎泺TT 2026-07-28

hermes的记忆系统和自我进化机制是它最大的优点  也是最大的缺点 , 它并不能很好的 管理自己的记忆,比如我三天前让它执行一个任务 它把会任务流程记忆下来 ,但是如果我两天前又通过其他方式更改过这个任务 ,那它就完全陷入记忆混乱  它还是会按照三天前的记忆去处理  完全不管你后面做的变更   导致始终找不到重点和正确的任务路径

♥ 68 ↩ 30

木不不不不不不不 2026-07-28

十分建议高强度用ai coding的用户,去尝试用用pi agent,如果追求claude code一样的体验的话就用oh-my-pi,如果只是随便用用就装纯净版,然后让他装个sub-agent的package,这个agent harness特别纯粹,可定制性特高,有什么缺了你直接和他反映就可以马上添加上对应的功能

♥ 50 ↩ 12

金鱼锅 2026-07-29

我不确定UP实际的流程是怎么样的,但是听起来好像UP在这次搞砸了的做法上,Hermes并没有用对。 Hermes处理复杂任务的情况,没法靠单一Agent的,本身Hermes的特点就偏向个人助理,自进化。 势必各种任务的复杂记忆、关于你个人的记忆、各种各样的不同领域的skill和工具,等等全作为prompt在会话开始载入的话,prompt能有多重,用过llm的都很容易想象。 我用下来觉得,真正的能用的舒心的做法是分层: 第一层,1-2个大总管agent(比如一个日常事务,一个肉偏技术类事务),这是主要交流的入口,也是对复杂任务拆分分配的第一层。 ↓ 第二层,各路用的上的专家,比如你的数据库处理就值得建一个,这个专家的soul、工具、skill、以及基于llm wiki的知识库都围绕着他的专精范围设定,这个专家的初始prompt一定是比大总管轻量化的。 可以和他们直接交互的聊需求,也可以接受大总管通过kanban传递过来的整块任务,视任务简单还是复杂,是否有重复性,agent可以选择是否再次拆分,订计划分任务。 ↓ 第三层(如果需要): 纯worker,基本不会和它聊天,单纯做一些专门且重复性强的任务用的,视情况如果是可以用soul去约束的重复类别,则做个专门的worker,用kanban去做。如果重复性不强,自由度偏高则用delegaion 建立子agent并由第二层写prompt塞技能分派任务。 这样分配的话,我个人感觉在处理事务方面,其实Hermes并不比那些,比如编程或其他的计算机专精技术agent方案差。 只不过初期配置可能要多花费不少精力,但只要是经常涉及的领域,之后用起来就爽了。 视频里把Hermes比做老头乐,其实并不是,Hermes更像一个专家自由选的公司。 但如果处理某些业务不招人,不建立公司组织架构,作为总裁只揪着光杆总经理一个人嚯嚯,这总经理是又当秘书又得当底层员工,还得照顾总裁的情绪和日常起居。 这用活人大概也受不了。

♥ 41 ↩ 9

叉烧水饺 2026-07-29

hermes确实很喜欢自作主张,我的已经被我骂到,每一步操作都要我点头才动手了[笑哭]

♥ 30 ↩ 2

农夫山间有点田 2026-08-01

我一直用 Hermes 配 ds,然后我给配了个千问的 vl 模型去识图,但是那个 api 绑了,死活连不上,我让 Hermes 自己检查,折腾四十分钟,没搞定,我请 codex 出来查了,三十几秒,就发现那个 api 是国外的,国内连不上,顺便修复了,花了四十来秒[惊讶][惊讶],没有对比就没有伤害。。另外,我要吐槽千问那个鬼东西,不说模型好坏,你想充个钱,阿里云那网页找半天也找不到在哪里,真是服了。最后算求了,下了个 Hermes studio,配了个第三方,用 gbt 吧

♥ 31 ↩ 6

宇宙霸主OvO 2026-07-27

关于hermes二话不说就开干的问题,我制定了一个规则,只要我说的话后面有qqqq,就只回答不执行。必须约束一下她的干劲[笑哭]

♥ 24 ↩ 7

蓝藻o 2026-07-27

hermes编程是认真的吗[笑哭]

♥ 24 ↩ 11

白疯零落 2026-07-27

我就是日常用hermes加ds,然后codex加gpt去处理更复杂的任务

♥ 19 ↩ 7

neko_IN_Corner 2026-07-27

Hermes是可以学习使用者的助手,如果使用者自己能力不行拉不住缰绳,那就不建议用;Claude是专精强化的agent,是会更自信,但如果完全相信他那总有一天还是会捅你一刀大的,总之哪个都不适合弄数据库,其次凡事都要能回退

♥ 11

Physics3r 2026-07-28

hermes总是瞎写记忆瞎创skill

♥ 9

发霉的罐头 2026-07-29

hermes更多是作为助理,自下而上的协助你。 codex更多是作为一个工程一个项目,做完就收工。 这是我个人的一种看法,如果有很强的目的要开发什么项目,那用codex。如果只是日常工作协助,那就hermes.a

♥ 8

不二龍渊 2026-07-28

有没有可能hermes本体就是一个很烂的agent.它那些 more active 机制,自过拟合进化[doge]

♥ 8

福寿草fukujuso 2026-08-07

你拿coding agent和general agent在比什么?你是不是连agent种类都搞不清楚

♥ 7

茗之沨 2026-07-28

选CC+ds 个人最具性价比的选择

♥ 9

Tracer-s 2026-07-28

我是从 hermes 转移到 codex,主要原因是需要桌面 Agent 工具,虽然 hermes 也有桌面端,但和 codex 还是差不少。 codex + cc Switch 使用别的模型还行,甚至可以远程,今天脑子一抽 三方的都这么好用 干脆我用官方的吧,于是乎订阅了plus  没想到这个官方的是个拧巴模型,有种特殊的道德约束,让他给我生成一批假数据测试用 然后不知道怎么个意图识别 死活不同意,就算是真造假责任人也是我 AI 又没法担责它还不同意了。 还有一个是我需要用 hunter fofa找一些同类站点,三方模型都没事,就这个官方模型 codex 给我禁止,说什么让我填个什么网络安全授信访问的东西  管太宽了。 真是后悔订阅了。

♥ 6 ↩ 2

我行-我上 2026-07-28

我Hermes主要用来复制我自己的行为习惯,跟养娃一样,让她当经理来操作Claude工作

♥ 6 ↩ 1