Codex干了18天的项目,Kimi K3用18小时就干完了…… 国产模型高难度真实项目实测

Description
K3在发布之后各种刷榜,于是身边有很多人好奇,来问我它的真实水平如何,这条视频就是我能想到的答案~

Comments

纪城Boolean 2026-07-27

拉满为敬[doge]

♥ 259 ↩ 38

雾雨孤影 2026-07-27

kimi 真该把五小时给去掉,还有月额度,现在kimi能力是有了,但说实话目前性价比真不如chatgpt,价格也比100刀的Gpt贵。ChatGPT 一直给重置。没办法,也理解现在算力紧张,现在Gpt我是用pro,Kimi也是最高档,但是kimi周额用完后 Gpt还有百分之20左右[笑哭],但是说不定明天GPT又重置额度了。

♥ 190 ↩ 27

-dysorder 2026-07-27

codex做大项目真的脑溢血,喜欢我写入一个文件查一次哈希值然后再重新查一次哈希值确保跟我前一次查的哈希值结果一样吗[呲牙]

♥ 99 ↩ 13

耄耋007 2026-07-28

我是一名基础数学博士生,想请问一下,gpt5.6pro和kimi K3 allegro,在前沿且复杂的基础数学证明上,哪一个更强呢?

♥ 104 ↩ 62

瓜瓜大爷123 2026-07-28

我两个都订阅且大量用过。我觉得不一定是谁比谁强。而是你先用一个踩一遍坑后,用后一个就会顺畅很多

♥ 79 ↩ 4

HAHA月生 2026-07-27

用了几天,果断退订gpt,给kimi提档位[doge]

♥ 109 ↩ 5

Try-E 2026-07-28

我觉得相信codex18天做完,这模型18小时做完的都是神人啊

♥ 75 ↩ 32

PathTracing 2026-07-27

K3强是强,但是现在最大的问题是套餐额度不够用,我是199的套餐,之前K2.6的时候开集群每个月还能剩下一些,现在只要开了集群,额度库库的掉[大哭]

♥ 56 ↩ 14

沙雕型甜柚子 2026-07-27

最好是调用官方的API解决成本跟难度问题,试了一晚上,完整模型就算量化后也需要官方所说的1.4TB的显存。 我试了5090 20 * 32GB = 640GB 这种规模可以运行中等规模的所有开源模型,模型跟张量并行协同训练可以获得更快的运算方式,已经算是个小超算集群。 本地小模型 + K3 API 最简单的的部署方案,也是绝大多数人可以接受的最低成本。 另外KimiK3真的不便宜,独立部署是论分钟按千来烧的。目前没有多余的算力给C端用户,只能把他们抛掉。

♥ 43 ↩ 1

账号刚注销2333333333 2026-07-28

难道只有我在等v4吗?[doge]

♥ 38 ↩ 10

成女玩家 2026-07-28

能再软文点吗,就算要吹Kimi也不用起这种标题,真当别人不用gpt5.6吗

♥ 52 ↩ 4

大脑回收处 2026-07-28

我刷了不少测评和推特吐槽。目前我对国内ai的印象就是:稍逊于国外ai水平,不过差距已经很短了,大概就几个月的差距了吧,然后ai对比不能只看一方面,而且因为是国内ai,更适合国内宝宝体质,某些方面已经优于国外ai。现在kimi是最强的国内ai,不过很贵,比gpt和claude都贵,至少gpt有某些渠道,可以很便宜[OK]。 大家觉得我的印象对不对。

♥ 37 ↩ 15

学理工救不了古罗马人 2026-07-27

目前我看到计算是kimi 199套餐一个月能用6.6亿token,然后gpt plus大概也是6-7亿,而且gpt只要140不到,有重置,有codex的生态,还有image 2,网页端不计入费用,kimi拿头打?

♥ 46 ↩ 17

EEFKenC 2026-07-27

感觉个人有没有相关知识还是很重要的,像视频里说的这个二进制序列化剧本问题,遇到那都是直接告诉ai去设计好序列化和反序列化器先,就算问它解决方案,提到这种搞等长offset方案那就是想都不用想秒否决掉的。 单纯替换剧本文件挺麻烦的,其实可以反编译找到它台词读取的地方进行注入HOOK,本地准备好个词典让它台词每次读取后进行一次索引更换就好,这样就不用去解包反序列化修改替换序列化封包一整套麻烦流程了,特别后续修翻译的一些瑕疵需要修改的时候。 对那些知道该怎么做有大概思路的问题交给ai,那就是事半功倍,而对于一知半解的问题丢给ai那就是抽卡游戏,只是在看能不能抽出个合心意的结果。模型区别就看它能不能长期胜任你的需求,真要测还得叫它干你擅长的事且你能评估它做出来的结果。 对于 codex,让5.5干这种事起码开个极高来干吧,让sol 5.6干,起码开个最高来进行规划先,其次避免使用多agent功能(不多说,自己判断需不需要开)。 到需要文本翻译时再更换推理程强度或更换便宜模型(没必要用那么高,token随便蹬那就当我没说)。

♥ 23 ↩ 1

伊鲁席尔的洋葱骑士 2026-07-27

碰瓷codex+gpt5.6有点夸张了。

♥ 29 ↩ 16

华sir努力摸鱼 2026-07-27

大黑老师用的是kcode+k3吗还是codex+k3呀[脱单doge]

♥ 20 ↩ 17

香辛料与Lawrence 2026-07-28

看来k3在宣传上确实花了不小的功夫。

♥ 25

让我康康是谁在白嫖 2026-07-27

[笑哭]之前 cursor 开的年订阅偶尔跑 fabel5 和写项目注释用了,然后 codex 水果卡 100 刀订阅一个月六百多每个月能跑完,kimi 则是我的项目前端和 ppt 帮手,[doge]说什么花钱上班,现在老子是天才程序员!一天干完半年的活,然后库库看小说

♥ 16 ↩ 6

Try-E 2026-07-28

太高度真实了🤣笑死了,当别人没用过codex

♥ 26 ↩ 2

夜梦心语 2026-07-28

我一周用了接近10B token,kimi不够登的。至于前端审美和gpt思维发散问题,只能说真有小白无脑开ultra。前端要用sol medium+gpt image生成预览图,日常任务luna max/sol medium,困难任务sol max。从0开始开发/底层重构用sol max

♥ 11 ↩ 1