大型语言模型中的注意力机制图解(中文配音)
合集 · 直观理解机器学习和深度学习 (18)
-
直观理解正态分布(PDF, CDF, PPF)
5:27
-
从数值和视觉上理解贝叶斯定理
4:07
-
论文中常见基础数学符号
4:06
-
论文中常见求和与乘积数学符号
4:05
-
直观理解机器学习中的线性回归
3:23
-
直观理解皮尔逊相关系数(r)和决定系数(r平方)
3:28
-
直观理解机器学习中的逻辑回归
3:29
-
直观理解机器学习中的神经网络
4:07
-
大型语言模型中的注意力机制图解(中文配音)
21:02
-
【中文配音】Mamba:比Transformers更好更快的模型
31:51
-
(中文配音)直观解释所有机器学习模型
44:46
-
(流畅中文配音)直观解释所有机器学习模型
22:23
-
(中文配音)制作令人印象深刻的可视化图表
7:54
-
(流畅中文配音)符合生物机制的学习算法
26:52
-
(英语原声)符合生物机制的学习算法
26:52
-
K-均值聚类动画演示
2:14
-
为什么LoRA能省下训练资源?一个宝藏比喻讲透低秩适配
25:56
-
本世纪被引用最多的论文是一篇出色的巧妙之作
28:36
Description
本视频为个人学习所收集,为方便快速理解,已将视频原英文配音转成中文,原视频地址为:https://www.youtube.com/watch?v=OxCpWwDCDFQ; 这段文字是关于注意力机制的讲解,作者是塞拉诺学院的路易斯·塞拉诺。视频主要介绍了注意力机制在大型语言模型中的作用,以及如何使用注意力来解决词义歧义问题。作者首先解释了嵌入的概念,然后详细介绍了自我注意力和多头注意力的原理和应用。
Comments
嵌入的工作做得越板正 语言模型的效果就越好
♥ 4
希望后面两部 [呲牙][呲牙][打call]
♥ 2 ↩ 3
太棒了!关注希望看到另外两部哦[打call]
♥ 2 ↩ 4
我看着苹果在吃苹果,哇!这苹果,这苹果好像不怎么样[doge]
♥ 1 ↩ 1
学习了
这个解释的很清晰