为什么是 CookLLM
会调包,不等于懂原理
当模型出问题时,只会调 API 的人束手无策;理解底层实现的人才能定位、优化、改进。CookLLM 带你走完后者的路。
把模型当黑盒
- 只会 import 现成库,参数全靠试
- 训练发散、显存爆了,不知从何查起
- 面试一问底层实现就卡壳
- 论文看得懂公式,却落不成代码
从零构建每一层
- 亲手实现每一个核心模块,不留盲区
- 出问题时知道根因在哪、该怎么改
- 从第一性原理推导,面试对答如流
- 公式与代码一一对应,真正掌握
课程大纲
原理精讲六大板块 + 动手训练主线,覆盖训练一个 LLM 的每一个关键环节
原理精讲
六大板块,从地基到前沿
围绕「训练一个 LLM 必须做出的关键决策」组织,从语言模型地基一路覆盖到后训练对齐。
- 基础Tokenization · Transformer · 优化
- 系统GPU Kernels · 并行 · 推理加速
- 规模化Scaling Laws · 算力预算
- 数据清洗 · 过滤 · 去重 · 混合
- 评估Benchmark · 解析 · 可靠性
- 后训练SFT · RLHF · GRPO · DPO
动手训练
从零训练并对齐一个小模型
对应 cookllm-bento 代码库,从数据、分词器到预训练、微调与对齐,端到端跑通一个自己的小模型(BentoLM 29M→134M)。
- 数据准备下载 · 清洗 · 打包
- 分词器训练RustBPE · tiktoken
- 模型搭建BentoLM · RoPE · Muon
- 预训练基座建模 · Lightning
- 中期训练长上下文 · RoPE 缩放
- 后训练对齐SFT · RLHF · PPO
课程特色
不只是看懂,而是真正动手写出来
从零实现
不依赖现成框架的高层封装,每个核心模块都从第一性原理亲手实现。
交互式文档
公式、图示与可运行代码结合,边读边跑,理解更直观。
配套代码库
原理精讲 (recipes) 与动手训练 (bento) 两套完整代码,对照文档随时查阅。
私有仓库 + 终身更新
一次买断,永久解锁 GitHub 私有仓库与后续所有更新章节。
定价
一次买断,终身访问全部章节与代码
终身版
$139US$39
一次性付款获得所有高级功能
- 全套可运行源码
- 独家交互式可视化
- 模型训练深度拆解
- 生产级实战项目
- 享受内容永久免费更新
- 解锁现有及未来所有课程章节
- 实验性功能 (Beta) 抢先体验
常见问题 (FAQ)
关于课程内容、适合人群与学习方式的解答