
GUIDED SERIES · 16 节课
大模型原理游戏课:模型工坊 16 关
从 token 到注意力、KV 缓存、训练与对齐,操作参数、完成任务,在一场模型锻造远征中学会 LLM。
- 课程数量
- 16
- 预计总时长
- 362 分钟
MODEL FORGE / QUEST MAP
穿过 16 道关卡,亲手拼出一个语言模型
每一关先建立一个机械直觉,再操作参数、完成检查点。进度和 XP 只保存在你的浏览器中。
WORLD 01
世界一:文本进入机器
WORLD 02
世界二:Transformer 核心零件
01
可挑战04|注意力雷达:每个位置怎样读取其他位置
24 分钟 →02亲手走过 Q、K、V、因果遮罩与加权汇总。
可挑战05|多头小队与 GQA:并行观察而不重复搬运
22 分钟 →03理解多头子空间、拼接投影和分组查询注意力的缓存收益。
可挑战06|RoPE 位置罗盘:用旋转编码先后与距离
22 分钟 →04从二维旋转走到相对位置点积,理解长上下文外推风险。
可挑战07|RMSNorm 稳压器:深层网络如何控制尺度
18 分钟 →05理解均方根归一化、可学习缩放与 pre-norm 残差结构。
可挑战08|门控 MLP 工坊:逐位置加工特征
21 分钟 →理解扩展维度、SiLU 门控、逐元素乘法与残差回流。
WORLD 03
世界三:从隐藏状态到生成
WORLD 04
世界四:训练、对齐与完整系统
01 · OVERVIEW
课程介绍
这不是一组只读文章。你会进入四个世界、完成 16 道关卡:先建立机械直觉,再阅读完整推导,操作信号实验,通过检查点获得 XP。每课都包含例子、误区、手算或编码实验与权威资料,既适合第一次系统学习,也适合作为工程复习地图。
适合人群
对大模型好奇但不想从厚重数学教材起步的学习者;需要补齐 Transformer、解码、缓存与训练全景的产品、设计和工程人员。
你将学会
追踪一次端到端生成的数据流;手算注意力、softmax 与缓存规模;解释 GQA、RoPE、RMSNorm 和门控 MLP;为不同任务选择解码策略;区分预训练、后训练与系统护栏。