Akina丶 2026-06-15 越强的模型越不用复杂提示词,但是你想要高质量的结果至少在提示词中明确表述你想要什么。如果你自己都不知道你自己想要什么,那你可能得不到一个质量比较高的结果 ♥ 6 ↩ 1
Lightning麦昆 2026-06-15 AI只和程序员,编程,码农相关吗,如果是这样,那么AI就不要发展了;数学,科学,逻辑,推理,写作,人文社科(尤其哲学,这是claude的强项),规划,研究与信息整理,图片与视觉内容,审阅反馈,脑洞创意等等等等,你能想到的,你想不到的都可以去尝试,claude的Fable 5模型就是在生物学领域的限制最严格,因为创意与风险并存。 ♥ 6 ↩ 2
这个月的第一天_ 2026-06-15 我现在只在使用codex gpt5.5来开发,看到Claude的模型这么强,想着到时候两个都订阅,一个项目在两个agent之间来回切换开发的话会有什么问题吗? ♥ 4 ↩ 13
Eran旧夏天 2026-06-17 前端简单?哪个大聪明说的?大模型最难做的部分之一就是前端,因为包括ui,交互效果,数据传递等。这部分内容本身就是语言描述模糊不清晰的。现在是模型很强了,但是你要做出产品级表现,且符合任何方面预期的产品,必须描述尽可能的清晰,如spec驱动开发,走的传统软件工程那一套,效果不是你几句提示词或者几轮对话就能够达到的。要是你说“给我做给类似xxmarkdown”的产品的话,它确实不用费什么劲,因为大模型本身就有这些开发经验,熟透于心。 ♥ 2
RockingSisyphus 2026-06-21 前端后端都一样,评判模型的关键不是它能从零搭出一个什么样的东西,而是它能不能在一个已经很大的项目的基础上进一步做正确的修改和修bug。前者虽然能评价ai的能力但和真实开发情况脱钩太多了。真正用ai开发就知道越到项目中后期越是折磨,得和ai来回拉锯。 ♥ 2
MechanicsLearnin 2026-06-15 现在好多模型还是太蠢了,试过codex和antigravity都不行。我想把github上液态玻璃效果用到我的网页中,复用成接口后总是会莫名其妙给我加一堆毛玻璃即使我强调不要再加模糊了。而且即使这样调用往往不成功。 ♥ 1 ↩ 3
haah4u 2026-06-24 UP,我给你出个点子:测评软件卸载能力。就是弄一堆流氓软件,这是你点左边,它跳右边,然后反复问你要不要卸载,一不小心又装回来,反正就是怎么都卸不干净那种。既考察了语言理解能力,又考察了UI的理解能力。 ♥ 1
Comments
感谢奥特曼不杀之恩[笑哭]
♥ 28 ↩ 11
还肥波呢模型都没了,存货狗[doge]
♥ 31 ↩ 1
快 去 测 G L M 5 . 2 [生气] [生气] [生气]
♥ 25 ↩ 3
越强的模型越不用复杂提示词,但是你想要高质量的结果至少在提示词中明确表述你想要什么。如果你自己都不知道你自己想要什么,那你可能得不到一个质量比较高的结果
♥ 6 ↩ 1
AI只和程序员,编程,码农相关吗,如果是这样,那么AI就不要发展了;数学,科学,逻辑,推理,写作,人文社科(尤其哲学,这是claude的强项),规划,研究与信息整理,图片与视觉内容,审阅反馈,脑洞创意等等等等,你能想到的,你想不到的都可以去尝试,claude的Fable 5模型就是在生物学领域的限制最严格,因为创意与风险并存。
♥ 6 ↩ 2
我现在只在使用codex gpt5.5来开发,看到Claude的模型这么强,想着到时候两个都订阅,一个项目在两个agent之间来回切换开发的话会有什么问题吗?
♥ 4 ↩ 13
建议下次生成游戏选 坦克大战 五子棋 象棋,而不是超级玛丽,赛车游戏[doge]
♥ 4 ↩ 1
前端简单?哪个大聪明说的?大模型最难做的部分之一就是前端,因为包括ui,交互效果,数据传递等。这部分内容本身就是语言描述模糊不清晰的。现在是模型很强了,但是你要做出产品级表现,且符合任何方面预期的产品,必须描述尽可能的清晰,如spec驱动开发,走的传统软件工程那一套,效果不是你几句提示词或者几轮对话就能够达到的。要是你说“给我做给类似xxmarkdown”的产品的话,它确实不用费什么劲,因为大模型本身就有这些开发经验,熟透于心。
♥ 2
那如果不做前后端,比如嵌入式工程师,FPGA开发,ASIC设计,应该怎么评判模型能力呢?
♥ 2 ↩ 4
视频里这效果怎么做的?
♥ 2 ↩ 1
前端后端都一样,评判模型的关键不是它能从零搭出一个什么样的东西,而是它能不能在一个已经很大的项目的基础上进一步做正确的修改和修bug。前者虽然能评价ai的能力但和真实开发情况脱钩太多了。真正用ai开发就知道越到项目中后期越是折磨,得和ai来回拉锯。
♥ 2
好漂亮的ppt啊 作为大学生想问问现在最能做ppt的大模型是哪些 这个ppt是用ai做的吗
♥ 2 ↩ 2
PPT做的不错,怎么做的[doge_金箍]
♥ 2 ↩ 3
但我觉得博主的测试有的时候确实不严谨,比如在网页端测。[笑哭][笑哭][笑哭]
♥ 3 ↩ 1
作为全栈,我认为前端比后端难多了,对ai来说更是如此,ai改前端组件库bug经常跑五轮以上,改后端就很少超过两轮的[吃瓜]
♥ 3 ↩ 2
还有个问题:为什么用网页端而不是api[doge]
♥ 1
现在好多模型还是太蠢了,试过codex和antigravity都不行。我想把github上液态玻璃效果用到我的网页中,复用成接口后总是会莫名其妙给我加一堆毛玻璃即使我强调不要再加模糊了。而且即使这样调用往往不成功。
♥ 1 ↩ 3
glm5.2 测试 听说 堪比opus4.6 在某些领域上 就是很慢 很谨慎 还有z的口碑问题[doge]
♥ 1
UP,我给你出个点子:测评软件卸载能力。就是弄一堆流氓软件,这是你点左边,它跳右边,然后反复问你要不要卸载,一不小心又装回来,反正就是怎么都卸不干净那种。既考察了语言理解能力,又考察了UI的理解能力。
♥ 1