源自上海交大研究生课程讲义的公益中文教程:用可运行 Notebook 带读者实践微调部署、思维链、知识编辑、越狱攻击、RLHF 对齐等核心技术点,完全免费。国内成体系又可动手的中文大模型材料长期稀缺。本教程脱胎于上海交大正式课程(NIS8021 自然语言处理前沿技术、NIS3353 人工智能安全技术),学术权威性与实操性兼备;选题紧跟热点——蒸馏迷你 R1 的数学推理、GUI Agent 替你点外卖都是热议方向,口碑在中文学习者圈持续发酵,直接反映为每月五千余星的惊人增速。

| 项目 | 内容 |
|---|---|
| 仓库 | Lordog/dive-into-llms |
| 语言 / 许可证 | Jupyter Notebook / 未标注 |
| 总星标 | ⭐ 50255 |
| 本月净增星标 | +5029 |
| 榜单 | GitHub官方月度趋势榜 第35名 |
源自上海交大研究生课程讲义的公益中文教程:用可运行 Notebook 带读者实践微调部署、思维链、知识编辑、越狱攻击、RLHF 对齐等核心技术点,完全免费。
国内成体系又可动手的中文大模型材料长期稀缺。本教程脱胎于上海交大正式课程(NIS8021 自然语言处理前沿技术、NIS3353 人工智能安全技术),学术权威性与实操性兼备;选题紧跟热点——蒸馏迷你 R1 的数学推理、GUI Agent 替你点外卖都是热议方向,口碑在中文学习者圈持续发酵,直接反映为每月五千余星的惊人增速。
7. 大模型隐写:在回答中夹带只有自己人能识别的暗号;
8. 多模态 / GUI Agent / 智能体安全:多模态入门、让 AI 点外卖购物、开放场景风险意识;
9. RLHF 安全对齐:基于 PPO 的人类反馈强化学习实验指南;
10. 国产化番外:联合华为昇腾上线《大模型开发全流程》公益课,分初/中/高级,覆盖课件、手册、视频与迁移调优。
每章三板斧:课件 PDF 讲原理、README 给步骤、ipynb 供运行验证,排在 documents/chapterX/ 下。技术栈贴合 PyTorch + HuggingFace 主流生态,开发团队横跨上海交大与新加坡国立大学,2025 年 6 月扩充数学推理、GUI Agent 等主题后仍持续迭代。
克隆仓库即得全部材料:
git clone https://github.com/Lordog/dive-into-llms.git
建议自备 Python 与深度学习环境;轻量章节 Colab 可完成,微调与 RLHF 章节对显存要求较高。国产化课程见昇腾社区"大模型开发学习专区"。
进入 documents/chapter1/README.md 运行配套 notebook 完成训练—评估—部署闭环;进阶挑战 chapter4/sft_math.ipynb 复现推理模型训练流程;安全方向可翻开 chapter6 越狱攻击教程对照实验。
相比 HuggingFace 官方英文课程,本项目胜在母语语境与国内热点同步;对比微软 generative-ai-for-beginners 少了产业广度,但安全攻防、对齐等学术向深度更强;《动手学深度学习》(D2L) 偏基础网络原理,本教程恰是其大模型时代的续篇。