Description
本视频深入浅出地解析了以ChatGPT为代表的大型语言模型(LLM)的完整构建与工作原理。内容涵盖从数据收集、分词、预训练的基础知识,到监督微调、强化学习(RLHF)等关键训练阶段,系统阐述了模型如何从海量文本中学习,并最终具备对话与推理能力。视频同时探讨了模型的局限性(如“幻觉”问题)、性能优化方法(如工具调用),以及未来多模态与智能体的发展趋势,为你构建理解AI的完整心智模型。
----------------------------------------------------------------
00:00:00 引言
00:00:58 预训练数据(互联网)
00:07:38 分词技术详解
00:14:06 神经网络输入与输出
00:19:43 神经网络内部机制
00:25:25 推理技术
00:30:32 GPT-2:训练与推理过程
00:42:09 Llama 3.1 基础模型推理演示
00:58:19 从预训练到后训练
01:00:00 后训练数据(对话)
01:19:08 幻觉问题、工具调用与知识工作记忆
01:40:05 自我认知
01:45:13 模型需要思考的"代币
01:59:17 分词机制再探讨:模型拼写能力面临挑战
02:02:58 锯齿状智能
02:05:38 监督微调到强化学习的演进
02:12:48 强化学习
02:25:45 DeepSeek-R1 模型详解
02:40:04 AlphaGo
02:46:09 基于人类反馈的强化学习(RLHF)
03:07:05 未来趋势前瞻
03:12:37 大语言模型发展追踪
03:15:55 如何寻找大型语言模型
03:19:07 总体概述
----------------------------------------------------------------
原标题:Deep Dive into LLMs like ChatGPT
原作者:Andrej Karpathy
发布日期:2025-02-05
视频链接:https://www.youtube.com/watch?v=7xTGNNLPyMI
Comments
这中文配音听着非常舒服,up主牛啊~[打call]
♥ 5
[呲牙]牛啊,用什么工具做的语音啊
♥ 2
牛啊,解决我顾着看字幕顾不上他说啥的痛[笑哭]
♥ 1
up好牛啊 不是那种机械的英翻中。听着很自然
♥ 1
牛
♥ 1
Upy用的什么工具翻译的呀
这个频道 真牛逼!
一键三连[吃瓜][打call]
牛逼 语音都复刻了
[点赞][点赞][点赞]
做得好好!!