首页00月度趋势榜01新星榜02增速榜03HF热榜04总表05搜索06

Lordog/dive-into-llms

源自上海交大研究生课程讲义的公益中文教程:用可运行 Notebook 带读者实践微调部署、思维链、知识编辑、越狱攻击、RLHF 对齐等核心技术点,完全免费。国内成体系又可动手的中文大模型材料长期稀缺。本教程脱胎于上海交大正式课程(NIS8021 自然语言处理前沿技术、NIS3353 人工智能安全技术),学术权威性与实操性兼备;选题紧跟热点——蒸馏迷你 R1 的数学推理、GUI Agent 替你点外卖都是热议方向,口碑在中文学习者圈持续发酵,直接反映为每月五千余星的惊人增速。

语言
Jupyter Notebook
⭐ 总星标
50,255
📅 创建
早期项目
🍴 Forks
0
许可证
未标注
🔥 本月净增
+5,029
在 GitHub 打开 回到总表

配图

信息卡

项目内容
仓库Lordog/dive-into-llms
语言 / 许可证Jupyter Notebook / 未标注
总星标⭐ 50255
本月净增星标+5029
榜单GitHub官方月度趋势榜 第35名

一句话定位

源自上海交大研究生课程讲义的公益中文教程:用可运行 Notebook 带读者实践微调部署、思维链、知识编辑、越狱攻击、RLHF 对齐等核心技术点,完全免费。

趋势解读:为什么火

国内成体系又可动手的中文大模型材料长期稀缺。本教程脱胎于上海交大正式课程(NIS8021 自然语言处理前沿技术、NIS3353 人工智能安全技术),学术权威性与实操性兼备;选题紧跟热点——蒸馏迷你 R1 的数学推理、GUI Agent 替你点外卖都是热议方向,口碑在中文学习者圈持续发酵,直接反映为每月五千余星的惊人增速。

核心功能拆解

7. 大模型隐写:在回答中夹带只有自己人能识别的暗号;

8. 多模态 / GUI Agent / 智能体安全:多模态入门、让 AI 点外卖购物、开放场景风险意识;

9. RLHF 安全对齐:基于 PPO 的人类反馈强化学习实验指南;

10. 国产化番外:联合华为昇腾上线《大模型开发全流程》公益课,分初/中/高级,覆盖课件、手册、视频与迁移调优。

架构与技术栈浅析

每章三板斧:课件 PDF 讲原理、README 给步骤、ipynb 供运行验证,排在 documents/chapterX/ 下。技术栈贴合 PyTorch + HuggingFace 主流生态,开发团队横跨上海交大与新加坡国立大学,2025 年 6 月扩充数学推理、GUI Agent 等主题后仍持续迭代。

安装与环境要求

克隆仓库即得全部材料:

git clone https://github.com/Lordog/dive-into-llms.git

建议自备 Python 与深度学习环境;轻量章节 Colab 可完成,微调与 RLHF 章节对显存要求较高。国产化课程见昇腾社区"大模型开发学习专区"。

快速上手示例

进入 documents/chapter1/README.md 运行配套 notebook 完成训练—评估—部署闭环;进阶挑战 chapter4/sft_math.ipynb 复现推理模型训练流程;安全方向可翻开 chapter6 越狱攻击教程对照实验。

进阶使用要点

典型应用场景

同类生态位对比

相比 HuggingFace 官方英文课程,本项目胜在母语语境与国内热点同步;对比微软 generative-ai-for-beginners 少了产业广度,但安全攻防、对齐等学术向深度更强;《动手学深度学习》(D2L) 偏基础网络原理,本教程恰是其大模型时代的续篇。

资源导航

← 上一篇microsoft/generative-ai-for-beginners下一篇 →ggml-org/llama.cpp