上海交大《动手学大模型》系列编程实践教程(总介绍)

本文摘要上海交大《动手学大模型》系列# 编程实践教程(总介绍)上海交通大学《自然语言处理前沿技术》(NIS8021)、《人工智能安全技术》(NIS3353)课程讲义拓展而来的公益编程实践教程。项目作者:Lordog 等课程来源:上海交通大学 张倬胜老师项目仓库:https://github.com/Lordog/dive-into-llms系列定位:面向大模型初学者的免费编程入门参考,帮助读者通过简单实践...

上海交大《动手学大模型》系列# 编程实践教程(总介绍)

上海交通大学《自然语言处理前沿技术》(NIS8021)、《人工智能安全技术》(NIS3353)课程讲义拓展而来的公益编程实践教程。

动手学大模型总览


一、项目动机

《动手学大模型》系列教程属于公益性质、完全免费。它不像普通理论讲义那样只讲概念,而是把“跑通代码、看到结果”放在第一位。通过每章一个主题的动手实验,读者可以:

  • 在真实代码中理解大模型的关键能力边界;
  • 快速复现论文里的核心 trick;
  • 把课堂知识转化为可展示、可迭代的 Demo。

二、教程目录

本系列共 11 章编程实践教程,覆盖微调部署、提示工程、知识编辑、数学推理、水印、越狱、隐写、多模态、GUI 智能体、智能体安全与 RLHF 对齐等前沿方向。

序号章节主题一句话介绍
1微调与部署预训练模型微调与部署指南:想提升预训练模型在指定任务上的性能?让我们选择合适的预训练模型,在特定任务...
2提示学习与思维链大模型的 API 调用与推理指南:“AI 在线求鼓励?大模型对一些问题的回答令人大跌眼镜,但它可能只...
3知识编辑语言模型的编辑方法和工具:想操控语言模型在对指定知识的记忆?让我们选择合适的编辑方法,对特定知识进行...
4数学推理如何让大模型学会数学推理?让我们快速蒸馏一个迷你 R1!
5模型水印语言模型的文本水印:在语言模型生成的内容中嵌入人类不可见的水印。
6越狱攻击想要得到更好的安全,要先从学会攻击开始。让我们了解越狱攻击如何撬开大模型的嘴!
7大模型隐写“看不见的墨水”!想让大模型在流畅回答的同时,悄悄携带只有“自己人”能识别的信息吗?大模型隐写告诉你...
8多模态模型作为能够更充分模拟真实世界的多模态大语言模型,其如何实现更强大的多模态理解和生成能力?多模态大语言模...
9GUI智能体想要饭来张口、解放双手?那么让我们一起来让 AI Agent 替你点外卖、回消息、购物比价吧!
10智能体安全大模型智能体迈向了未来操作系统之旅。然而,大模型在开放智能体场景中能意识到风险威胁吗?
11RLHF安全对齐基于 PPO 的 RLHF 实验指南:本教程”十分危险“,阅读后请检查你的大模型是否在冷笑。

三、适合谁读

  • 正在学习《自然语言处理》《人工智能安全》相关课程的学生;
  • 希望用代码快速理解 LLM 前沿子方向的科研人员;
  • 已有 Python 基础,想从“会用 API”进阶到“能改代码、能复现实验”的工程师。

四、配套资源说明

每章均提供三类核心材料:

  1. 课件 PDF:对应章节的完整讲义幻灯片;
  2. 教程 README:详细的实验步骤、环境配置与命令行示例;
  3. Jupyter Notebook:可运行、可修改的代码脚本。

本站已将 11 章材料分别整理成独立文章发布,并在每篇文章末尾提供 PDF 课件 + 源码包的直接下载链接。

五、学习路径建议

读者背景建议顺序
刚接触大模型第 1 章 → 第 2 章 → 第 4 章 → 第 8 章
关注安全可信第 5 章 → 第 6 章 → 第 7 章 → 第 10 章 → 第 11 章
关注应用落地第 1 章 → 第 9 章 → 第 8 章 → 第 10 章
想完整过一遍按 1 → 11 顺序依次阅读

六、更新日志

  • 2025/06/06:项目在原系列基础上新增数学推理、GUI Agent、大模型对齐、隐写术等主题;同时上线国产化《大模型开发全流程》公益教程(含 PPT、实验手册和视频)。

七、鸣谢

感谢上海交通大学自然语言处理实验室、华为昇腾社区对本系列教程的支持。


下一章第 1 章:微调与部署

觉得内容不错?我要

打赏杯咖啡或蜜雪冰城吧
微信扫一扫
微信赞赏码
支付宝扫一扫
支付宝赞赏码
评论 暂无评论
请登录后参与评论