🤖 AI 与大模型

200 行看懂 LLM(中):前向传播与 Attention

Understanding LLMs II: Forward Pass & Attention

11 章·8 分钟·9 篇技术深读
开启:视频讲到哪,技术深读自动跟到哪
0:00 0:00
章节(11)
B08 前向传播总览
B09 嵌入:把字符变成向量
B10 Transformer Block 的整体结构
B11 Q、K、V:注意力的三个角色
B12 打分与加权:注意力的核心运算
B13 多头:让模型从多个角度看
B14 残差连接与 RMSNorm
B15 MLP:非线性与维度变换
B16 输出:lm_head 与 logits
B17 Loss:交叉熵告诉模型错了多少
B18 收束与下集预告
技术深读站 · 作者 项思炼 · elane.xiangsilian.com