逐段讲解Kimi K2报告并对照ChatGPT Agent、Qwen3-Coder等:“系统工程的力量”

合集 · 技术之美 (7)

  1. 3:20:54
    逐篇讲解DeepSeek关键9篇论文及创新点——“勇敢者的游戏”
  2. 2:36:13
    逐篇讲解DeepSeek、Kimi、MiniMax注意力机制新论文——“硬件上的暴力美学”
  3. 2:29:42
    逐篇解析机器人基座模型和VLA经典论文——“人就是最智能的VLA”
  4. 2:33:43
    人类驯服可控核聚变还有多少路程?对能量奇点创始人杨钊3小时访谈
  5. 2:38:11
    宁德时代领投11亿!和王鹤聊:具身智能学术边缘史和资本轰炸后的人为乱象
  6. 2:20:39
    逐段讲解Kimi K2报告并对照ChatGPT Agent、Qwen3-Coder等:“系统工程的胜利”
  7. 4:22:38
    干货!开源一段论文探索之旅给大家
Description
我们又来读论文啦!!!

今天我们要读的论文是最近几个星期内最值得品读的几篇技术报告,分别是:Kimi K2、ChatGPT Agent、Qwen3-Coder的技术报告,以及Manus的一篇技术博文。他们的相关性是,这几篇内容都和Agent有关系。

今天的嘉宾是俄亥俄州立大学(The Ohio State University)的在读博士郑博元,他的研究方向是Language Agent,他会带我们一起读上述技术报告和博文。

这是《商业访谈录》的“技术之美”系列,期待和你一起读论文,领略科技平权,感受技术之美——做你的赛博组会:)


00:02:00 给Agent下定义和分类
00:14:50 Kimi K2、ChatGPT Agent、Qwen3-Coder、Manus的技术路线对比?
00:28:29 Agent Training 的关键环节:合成数据、强化学习、安全
00:30:57 第一篇技术报告:Kimi K2: Open Agentic Intelligence
https://github.com/MoonshotAI/Kimi-K2/blob/main/tech_report.pdf
00:43:50 第二篇技术报告访谈:Introducing ChatGPT agent: bridging research and action
https://openai.com/zh-Hans-CN/index/introducing-chatgpt-agent/
红杉访谈OpenAI:OpenAI Just Released ChatGPT Agent, Its Most Powerful Agent Yet
https://www.sequoiacap.com/podcast/training-data-chatgpt-agent/
01:53:38 第三篇技术报告:Qwen3-Coder: Agentic Coding in the World
https://qwenlm.github.io/blog/qwen3-coder/
01:59:04 第四篇技术博文:AI代理的上下文工程:构建Manus的经验教训(作者:Yichao 'Peak' Ji)
https://manus.im/zh-cn/blog/Context-Engineering-for-AI-Agents-Lessons-from-Building-Manus
02:06:06 展望:也许会有一个新的范式
02:15:20 我感觉Agent是“我拓展的大脑”,我背后有一个“军团”(Family of Agents)
02:16:41 不同Bot的语言风格:DeepSeek嘴臭,元宝舔狗

Comments

硅谷101Weekly_AI 2025-08-01

小珺,你这整得,都感觉是学术交流啦。不过我喜欢。感觉回到了十几年前和导儿一起,热点论文研讨会。[呲牙]

♥ 28

yukiwayx 2025-09-28

前30min笔记: Agent 定义- language agent: (1) 基于language model 去 build;(2) agent使用语言进行沟通交流、推理规划的载体 Language agent v.s. language model: - 是否存在环境:language agent 需要学会如何很好地和环境做交互: (1) perception 感知环境; (2) 生成执行action 影响环境 - 训练推理的范式不同:language model 接受input输出output; language agent: - (1) 感知环境,获得observation,这个观察随着agent所处的环境以及应用的类型有所不同 - (2) observation作为input的一部分(还包括agent需要完成的task、之前的交互记录)给language model处理,生成一个action - (3) 执行这个action,环境状态发生变化 典型应用:code、deepresearch、tool-use、computer-use,observation&action space会有很大区别

♥ 7 ↩ 1

铁锅炖圆神 2025-08-04

这个《昆3》还是太出戏了

♥ 7

Ryan0v0 2025-08-11

Boyuan讲得太好啦,逐帧学习[打call][打call]

♥ 4

loopiest 2025-08-02

这个大学,还有language agent的表述,我感觉他是yu su的学生

♥ 4

pandaupc 2025-08-09

宝藏,最近正在调研这个方向

♥ 2

bili_28603424431 2025-08-01

为博元打call

♥ 2

世界和平__peace 2025-08-15

硅谷101的配音?声音很好听

♥ 1

易寻fly 2025-08-01

好,听了音频再看视频

♥ 1

年糕很硬 2025-07-31

[打call]

♥ 1

流年FT 2025-10-31

研三在读,已写一篇一区,两篇二区加专利,有问题随时交流

秋之白华0731 2025-09-17

没有投屏,

豪华邮 2025-08-30

确定不是在讲论文?没看出来解了啥.....

二同学姐 2025-08-29

爱看,请多出学术论文讲解!

蹲下来抱抱自己 2025-08-14

rubric reward是啥呀

Benjiamin_strong 2025-08-10

建议配上文字

bili_3546913563478210 2025-08-05

前排[呲牙]

战魂777 2025-08-03

用过kimi 2的朋友觉得怎样?[吃瓜]

↩ 4

晒太阳222 2025-07-31

很有价值

贝尔格里尔尧 2025-07-31

第一[打call]