美式七分糖的午后 2026-07-07 ## ML面试终极指南 — 精简总结 作者 Silvia Sapora,博士毕业后拿到 DeepMind、Isomorphic Labs、Cohere、Meta 等 offer。 **拿面试门槛**:3+ 一作顶会论文 + 至少一段实习/工业经历。已有面试就停止堆论文,立刻转去准备。 **面试结构**:Coding(LeetCode Medium)、ML 手写(Transformer/Attention/反向传播从零实现)、ML 知识(基础+系统设计)、行为面。 **准备策略**:留至少一个月,针对每一家公司逐一攻破。资源推荐 Blind 75/NeetCode 150、Chip Huyen 的 ML 系统设计书、Gilbert Strang 线代课。用 Claude 做模拟面试效果很好。手写底线:Transformer、三种 Attention、Flash Attention、MLP 正反传、训练循环。 **核心技巧**:小公司排前面练手;让 offer 同期到达获议价权;告知所有公司你同时在面别家;公司可以大幅加价但会要证明。 **情绪管理**:焦虑正常,建立固定仪式(运动、整理仪容)。你的价值不由面试结果决定,允许自己搞砸。 **高频考点**:RL(PPO/DPO/GRPO/Bellman)、LLM(Flash Attention/LoRA/RoPE/Scaling Laws/MoE)、生成模型(扩散/Flow Matching)、通用(KL 散度/BN vs LN/AdamW/Bias-Variance)。 ♥ 2
Comments
## ML面试终极指南 — 精简总结 作者 Silvia Sapora,博士毕业后拿到 DeepMind、Isomorphic Labs、Cohere、Meta 等 offer。 **拿面试门槛**:3+ 一作顶会论文 + 至少一段实习/工业经历。已有面试就停止堆论文,立刻转去准备。 **面试结构**:Coding(LeetCode Medium)、ML 手写(Transformer/Attention/反向传播从零实现)、ML 知识(基础+系统设计)、行为面。 **准备策略**:留至少一个月,针对每一家公司逐一攻破。资源推荐 Blind 75/NeetCode 150、Chip Huyen 的 ML 系统设计书、Gilbert Strang 线代课。用 Claude 做模拟面试效果很好。手写底线:Transformer、三种 Attention、Flash Attention、MLP 正反传、训练循环。 **核心技巧**:小公司排前面练手;让 offer 同期到达获议价权;告知所有公司你同时在面别家;公司可以大幅加价但会要证明。 **情绪管理**:焦虑正常,建立固定仪式(运动、整理仪容)。你的价值不由面试结果决定,允许自己搞砸。 **高频考点**:RL(PPO/DPO/GRPO/Bellman)、LLM(Flash Attention/LoRA/RoPE/Scaling Laws/MoE)、生成模型(扩散/Flow Matching)、通用(KL 散度/BN vs LN/AdamW/Bias-Variance)。
♥ 2
所以连接呢[大哭]
♥ 1 ↩ 1