← Open Source
fancyboi999

ai-engineering-from-scratch-zh

Agent工程师最全学习路径 · 从零精通 AI 工程 · 20 阶段 503 课 · 中文全量翻译 + 配套站点 + 动画讲解视频 · 如何成为 AI Agent 工程师的修成指南

TutorialsAIE roadmapPython
Open on GitHub
Momentum
+10stars in 24 hours+0.9%
1.17k
Stars
183
Forks
—
This week
11
Contributors
Created 2026-05-26 · Updated 2026-10-05 · #950 today
Top developers
README

AI Engineering from Scratch · 简体中文版

从零开始,亲手实现每一个 AI 算法

523 节课 · 20 个阶段 · Python / TypeScript / Rust / Julia · 配套中文网站 aieng-zh.cn

在线阅读 aieng-zh.cn 523 lessons 20 phases MIT License GitHub stars

░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

通过推导、代码和实验学习 AI 工程。

523 节课,20 个阶段,覆盖 Python、TypeScript、Rust、Julia。课程配有中文正文、测验、 可运行示例和可复用产物。免费阅读,开源,采用 MIT 许可。

从基础算法到 LLM 应用、agent 与生产系统,按你的目标选择学习路径。

本项目是 AI Engineering from Scratch(作者 Rohit Ghumare,MIT 协议)的简体中文衍生版。衷心感谢原作者创作并开源了这套课程。

这个中文版做了什么

中文版提供课程翻译、配套视频、交互式学习网站和 AI 导师:

🇨🇳 全站简体中文 523 节课正文、243 条术语表、测验题、mermaid 流程图、交互图表标签全部中文化(agent、token、transformer 等技术术语按惯例保留英文)
🌐 独立中文网站 aieng-zh.cn 可搜索的课程目录、AI 工程学习路径、学习进度追踪、可拖动的交互式图表、命令面板(Cmd / Ctrl + K)、深色模式
🎬 配套动画讲解视频 333 节中文配音动画已上线,覆盖阶段 0–14 的全部课程。可在课程页内嵌播放,提供直链与 B 站播放源,配合正文、数学推导和代码实践学习
🔍 为 AI 检索优化 构建时自动生成 sitemap.xml / llms.txt / 结构化数据,方便被搜索引擎和 AI 助手引用
✅ 课数一致性护栏 CI 自动校验课程数(node site/build.js --check),防止课程列表与磁盘上的实际内容漂移

翻译怎么翻见 TRANSLATION.md。课程结构、代码与上游保持一致,译文持续跟进上游更新。

目录 · 从这里开始 · AI 导师 · 怎么运作 · 课程结构 · 学习路径 · 一节课的样子 · 快速开始 · 每节课都有产出 · 课程目录 · 工具箱 · 参与贡献

从这里开始:选择你想构建的内容

开始前不需要先扫完 523 节课。选一个目标即可。每个链接都对应 GitHub 或网站上的同一套课程,两处使用相同的课程代码。

你的目标 在 GitHub 上学习 在网站上学习
我是新手,想要完整地打牢基础 阶段 0 · 配置与工具链 开发环境
我懂 Python,想学数学与机器学习基础 阶段 1 · 数学基础 线性代数直觉
我想构建生产级 LLM 应用 阶段 11 · LLM 工程 提示词工程
我想构建自主 agent 阶段 14 · Agent 工程 Agent 循环
我想在真实代码仓库中使用 coding agent Agent 辅助工程路径 Agent 辅助工程
我想在编码实施前把产品方案想透定准 产品判断与交付路径 产品判断与交付
我想基于模型上下文协议(MCP)构建系统 模型上下文协议(MCP)路线 模型上下文协议(MCP)路径
我想编写并交付 Agent Skills Agent Skills 快速路线 Agent Skills 路径
我想备考 Claude 官方认证 认证入门指南 认证学院
我想备考 MCP Associate(MCPA) MCPA 入门指南 MCPA 路线

拿不准自己适合从哪开始?使用 start-learning 定位导师 或查看 网站前置要求指南。

在 AI 工程学习路径 中对比四大核心领域与六大职业发展路线。

30 秒添加 AI 导师

npx skills add fancyboi999/ai-engineering-from-scratch-zh
宿主 开始全课程 开始模型上下文协议(MCP) 开始 Agent Skills 运行阶段测验
Codex start-learning,或从 /skills 选择 learn-mcp,或从 /skills 选择 learn-agent-skills,或从 /skills 选择 check-understanding 13,或从 /skills 选择
Claude Code /start-learning /learn-mcp /learn-agent-skills /check-understanding 13
其他兼容宿主 使用 start-learning 开始课程。 使用 learn-mcp 开始模型上下文协议(MCP)路径。 使用 learn-agent-skills 开始 Agent Skills 工程路径。 使用 check-understanding 测验阶段 13。

运行你所在宿主的启动命令。导师会评估你当前的知识背景,把个性化学习计划保存到 LEARNING.md。从那里开始,learn 技能每次会话教学一节课:核心概念、数学直觉、编写代码、测验检验。它直接从本仓库流式读取课程,而 course-guide 技能可以在你卡住时精准跳转到对应课程。在 Codex 中,直接输入 learn 和 course-guide;在 Claude Code 中,输入 /learn 和 /course-guide;在其他兼容宿主中,按名称调用该技能即可。

只想要模型上下文协议(MCP)?使用宿主对应的 MCP 启动命令。它会生成 MCP-LEARNING.md,按照 模型上下文协议(MCP)清单 的 17 节课程路线,带你逐课实践无状态握手、服务端、客户端、传输层、采样、工具契约、可靠性与网关。

只想要 Agent Skills?使用宿主对应的 Agent Skills 启动命令。它会生成 AGENT-SKILLS-LEARNING.md,按照 Agent Skills 路径 的 5 节必修课程路线,带你实践编写规范、发现机制、渐进式披露、安全沙箱与发布门禁。

技能 作用
start-learning 定位导师。评估你当前的背景、设定学习目标、选择切入点,并生成 LEARNING.md。
learn 动手教学导师。从仓库流式读取课程,带你推导概念、运行代码,并进行测验检验。
learn-mcp MCP 专项导师。创建 MCP-LEARNING.md,遵循 17 课路线,记录协议线路、安全性、可靠性与一致性证据。
learn-agent-skills Agent Skills 专项导师。创建 AGENT-SKILLS-LEARNING.md,遵循 5 课路线,记录技能契约、渐进式披露与真实 runner 测试证据。
claude-certification Claude 认证导师。选择 CCAO-F、CCDV-F、CCAR-F 或 CCAR-P,逐课教学、运行实验、评审产物、组织诊断与模拟测验并保存进度。
mcpa-certification MCPA 认证导师。遵循 34 课路线,运行 MCP 实验和协议校验,组织诊断与模拟测验,并保存学习进度。
find-your-level 十道题的定级测验。把你的知识映射到一个起始阶段,生成带课时估算的个性化路径。
check-understanding 按阶段测验,八道题,附反馈和需要复习的具体课程。
course-guide 课程导引与概念查询。把任何主题或疑问映射到讲解该知识点的具体课程。
░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

怎么运作

大多数 AI 教材都是碎片化教学。这儿一篇论文,那儿一篇微调心得,别处再来个炫酷的 agent demo。这些碎片很少能拼到一起。你做出了一个聊天机器人,却讲不清它的 loss 曲线;你给 agent 挂了个函数,却说不出调用它的那个模型内部,attention 到底在干什么。

这套课程就是那根脊椎。20 个阶段,523 节课,四种语言:Python、TypeScript、Rust、Julia。 一头是线性代数,另一头是自主 agent 集群。每个算法都先从最原始的数学手写出来。反向传播、 分词器、注意力、agent 循环——等 PyTorch 登场时,你已经知道它底层在做什么了。

学习时结合问题背景、概念推导、代码实验、测验和产出练习。动画帮助理解核心直觉, 代码与实验用于检验掌握程度。各课列出所需依赖;涉及 GPU、云服务或模型 API 的实践按课程要求准备资源,相关服务费用由提供商收取。

░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

课程的结构

二十个阶段层层叠起来。数学是地基,agent 和生产部署是屋顶。下层的东西你已经会了,就尽管 往前跳;但别跳过去之后,又回头纳闷上层为什么塌了。

%%{init: {'theme':'base','themeVariables':{'primaryColor':'#fafaf5','primaryTextColor':'#1a1a1a','primaryBorderColor':'#3553ff','lineColor':'#3553ff'}}}%%
flowchart TB
  P0["阶段 0 · 配置与工具链"] --> P1["阶段 1 · 数学基础"]
  P1 --> P2["阶段 2 · 机器学习基础"]
  P2 --> P3["阶段 3 · 深度学习核心"]
  P3 --> P4["阶段 4 · 计算机视觉"]
  P3 --> P5["阶段 5 · NLP"]
  P3 --> P6["阶段 6 · 语音与音频"]
  P3 --> P9["阶段 9 · 强化学习"]
  P5 --> P7["阶段 7 · Transformer"]
  P7 --> P8["阶段 8 · 生成式 AI"]
  P7 --> P10["阶段 10 · 从零实现 LLM"]
  P10 --> P11["阶段 11 · LLM 工程"]
  P10 --> P12["阶段 12 · 多模态 AI"]
  P11 --> P13["阶段 13 · 工具与协议"]
  P13 --> P14["阶段 14 · Agent 工程"]
  P14 --> P15["阶段 15 · 自主系统"]
  P15 --> P16["阶段 16 · 多 agent 与集群"]
  P14 --> P17["阶段 17 · 基础设施与生产"]
  P15 --> P18["阶段 18 · 伦理、安全与对齐"]
  P16 --> P19["阶段 19 · 综合项目"]
  P17 --> P19
  P18 --> P19
░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

一节课的样子

每节课都待在自己的文件夹里,整套课程结构统一:

phases/-/-/
├── code/      可运行的实现(Python、TypeScript、Rust、Julia)
├── docs/
│   └── zh.md  课程正文
├── quiz.json  课前、课中与课后测验
└── outputs/   本节课的可复用产物

每节课都走六个节拍。其中 Build It / Use It(动手构建 / 实际使用)的拆分是整节课的脊椎—— 你先从零实现算法,再用生产级的库把同样的事跑一遍。你之所以懂框架在做什么,是因为那个更小的 版本你自己写过。

%%{init: {'theme':'base','themeVariables':{'primaryColor':'#fafaf5','primaryTextColor':'#1a1a1a','primaryBorderColor':'#3553ff','lineColor':'#3553ff'}}}%%
flowchart LR
  M["主旨  
一句话核心理念"] --> Pr["问题背景  
具体的痛点"]
  Pr --> C["核心概念  
图解与直觉"]
  C --> B["动手构建  
纯数学,不用框架"]
  B --> U["实际使用  
同样的事用 PyTorch / sklearn 跑一遍"]
  U --> S["拿去用  
提示词 · 技能 · agent · MCP"]

快速开始

三种入门方式。挑一个。

方式 A —— 阅读。 在 aieng-zh.cn 上打开任意一节已完成的课程, 或展开 目录 里的某个阶段。无需配置,无需 clone。

方式 B —— clone 下来跑。

git clone https://github.com/fancyboi999/ai-engineering-from-scratch-zh.git
cd ai-engineering-from-scratch-zh
python3 phases/00-setup-and-tooling/01-dev-environment/code/verify.py --route beginner
python3 phases/01-math-foundations/01-linear-algebra-intuition/code/vectors.py

方式 C —— 让 AI 导师带你学。 按上方宿主调用表调用技能。以下为 Claude Code 示例:

/start-learning      # 评估背景、设定目标并生成个性化 LEARNING.md
/find-your-level     # 十道题快速定级测验,映射起始阶段

按计划逐课学习,每学完一个阶段:

/check-understanding 3        # 测验你对阶段 3 的掌握
ls phases/03-deep-learning-core/05-loss-functions/outputs/
# ├── prompt-loss-function-selector.md
# └── prompt-loss-debugger.md

前置要求

  • 你会写代码(任何语言都行,会 Python 更好)。
  • 你想搞懂 AI 到底是怎么运作的,而不只是调调 API。

准备 Claude 认证

Claude 认证学院 是一套免费、开源的备考体系, 覆盖 Associate Foundations、Developer Foundations、Architect Foundations 和 Architect Professional 四条公开认证路线。每条路线都有对齐公开考试蓝图的课程、 可运行实验、诊断测验、综合项目和原创全真模拟题。

参照 AI-native GitHub 入门指南,可以在 Claude Code、 Codex、ChatGPT、Cursor 或其他 agent 中调用 claude-certification(Claude Code 使用 /claude-certification):选择路线、 把进度保存到 CLAUDE-CERTIFICATION.md,逐课学习、运行真实实验并接受基于产物的反馈。 同一套课程已在 中文认证站点 提供。

这是基于公开考试目标编写的独立学习材料,不隶属于 Anthropic,不包含真实考题, 也不保证通过认证。资格、费用、评分和项目政策可能变动,付费或预约前必须以官方最新说明为准。

准备 MCP Associate(MCPA)认证

MCPA 认证课程 提供 34 节中文课程、可运行的 MCP 协议实验和原创练习题。课程依据 2026-07-28 版规范组织五个知识域;从 入门指南 开始,使用 mcpa-certification 导师逐课练习,或在 中文认证站点 学习。

这套社区课程独立于 Agentic AI Foundation 和 Linux Foundation。正式考试政策以官方页面为准;模拟题成绩不等于正式考试分数。

内置 agent 技能

全套课程内置了 9 个涵盖定位、教学、专项路径与测验的 AI 导师技能,详见上文 30 秒添加 AI 导师;所有技能定义均位于 skills/ 目录下。

░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

每节课都有产出

别的课程结尾是一句 "恭喜,你学会了 X。" 这里每节课的结尾,是一件你能直接装上、 或粘进日常工作流的 可复用工具。

FIG_001.A prompts
FIG_001 · A
PROMPTS

FIG_001.B skills
FIG_001 · B
SKILLS

FIG_001.C agents
FIG_001 · C
AGENTS

FIG_001.D MCP servers
FIG_001 · D
MCP SERVERS

粘进任意 AI 助手,在某个细分任务上获得专家级帮助。

放进 Claude、Cursor、Codex、OpenClaw、Hermes,或任何能读 SKILL.md 的 agent。

作为自主 worker 部署——那个循环你在阶段 14 自己写过。

接入任意兼容 MCP 的客户端。在阶段 13 里从头到尾构建。

用 python3 scripts/install_skills.py 将课程产出技能安装到指定目录。 各课的 outputs/ 提供参考产物;把自己的实现、测试与复盘整理成作品集。

FIG_002 · 一个实例

阶段 14,第 1 课:Agent 循环。 Python 示例使用标准库和脚本化的 ToyLLM,可以离线观察工具调用、回合预算与停止条件。

python3 phases/14-agent-engineering/01-the-agent-loop/code/main.py

示例调用计算器和键值存储,输出执行轨迹,最终得到含 15% 税费的总价 138.0。 阅读 Python 实现、 TypeScript 实现,以及 可复用的 agent-loop 技能。

░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

课程目录

二十个阶段。点开任意阶段即可展开它的课程列表。

Phase 0: 配置与工具链 12 lessons

把环境准备好,迎接后面所有的内容。

# Lesson Type Lang
01 开发环境 Build Python
02 Git 与协作 Learn —
03 GPU 配置与云端 Build Python
04 API 与密钥 Build Python
05 Jupyter Notebook Build Python
06 Python 环境管理 Build Shell
07 面向 AI 的 Docker Build Docker
08 编辑器配置 Build —
09 数据管理 Build Python
10 终端与 Shell Learn —
11 面向 AI 的 Linux Learn —
12 调试与性能分析 Build Python

Phase 1 — 数学基础  22 lessons  每个 AI 算法背后的直觉,用代码讲清楚。

# Lesson Type Lang
01 线性代数直觉 Learn Python, Julia
02 向量、矩阵与运算 Build Python, Julia
03 矩阵变换与特征值 Build Python, Julia
04 机器学习里的微积分:导数与梯度 Learn Python
05 链式法则与自动微分 Build Python
06 概率与分布 Learn Python
07 贝叶斯定理与统计思维 Build Python
08 优化:梯度下降家族 Build Python
09 信息论:熵与 KL 散度 Learn Python
10 降维:PCA、t-SNE、UMAP Build Python
11 奇异值分解 Build Python, Julia
12 张量运算 Build Python
13 数值稳定性 Build Python
14 范数与距离 Build Python
15 机器学习里的统计学 Build Python
16 采样方法 Build Python
17 线性方程组 Build Python
18 凸优化 Build Python
19 面向 AI 的复数 Learn Python
20 傅里叶变换 Build Python
21 机器学习里的图论 Build Python
22 随机过程 Learn Python

Phase 2 — 机器学习基础  18 lessons  经典机器学习——至今仍是大多数生产 AI 的骨架。

# Lesson Type Lang
01 什么是机器学习 Learn Python
02 从零实现线性回归 Build Python
03 逻辑回归与分类 Build Python
04 决策树与随机森林 Build Python
05 支持向量机 Build Python
06 KNN 与距离度量 Build Python
07 无监督学习:K-Means、DBSCAN Build Python
08 特征工程与特征选择 Build Python
09 模型评估:指标与交叉验证 Build Python
10 偏差、方差与学习曲线 Learn Python
11 集成方法:Boosting、Bagging、Stacking Build Python
12 超参数调优 Build Python
13 机器学习流水线与实验追踪 Build Python
14 朴素贝叶斯 Build Python
15 时间序列基础 Build Python
16 异常检测 Build Python
17 处理不平衡数据 Build Python
18 特征选择 Build Python

Phase 3 — 深度学习核心  13 lessons  从第一性原理出发的神经网络。先自己造一个,再碰框架。

# Lesson Type Lang
01 感知机:一切的起点 Build Python
02 多层网络与前向传播 Build Python
03 从零实现反向传播 Build Python
04 激活函数:ReLU、Sigmoid、GELU 及其原因 Build Python
05 损失函数:MSE、交叉熵、对比损失 Build Python
06 优化器:SGD、Momentum、Adam、AdamW Build Python
07 正则化:Dropout、权重衰减、BatchNorm Build Python
08 权重初始化与训练稳定性 Build Python
09 学习率调度与 Warmup Build Python
10 造一个你自己的迷你框架 Build Python
11 PyTorch 入门 Build Python
12 JAX 入门 Build Python
13 调试神经网络 Build Python

Phase 4 — 计算机视觉  28 lessons  从像素到理解——图像、视频、3D、VLM 和世界模型。

# Lesson Type Lang
01 图像基础:像素、通道、色彩空间 Learn Python
02 从零实现卷积 Build Python
03 CNN:从 LeNet 到 ResNet Build Python
04 图像分类 Build Python
05 迁移学习与微调 Build Python
06 目标检测——从零实现 YOLO Build Python
07 语义分割——U-Net Build Python
08 实例分割——Mask R-CNN Build Python
09 图像生成——GAN Build Python
10 图像生成——扩散模型 Build Python
11 Stable Diffusion——架构与微调 Build Python
12 视频理解——时序建模 Build Python
13 3D 视觉:点云、NeRF Build Python
14 Vision Transformer(ViT) Build Python
15 实时视觉:边缘部署 Build Python
16 构建一条完整的视觉流水线 Build Python
17 自监督视觉——SimCLR、DINO、MAE Build Python
18 开放词表视觉——CLIP Build Python
19 OCR 与文档理解 Build Python
20 图像检索与度量学习 Build Python
21 关键点检测与姿态估计 Build Python
22 从零实现 3D 高斯泼溅 Build Python
23 Diffusion Transformer 与 Rectified Flow Build Python
24 SAM 3 与开放词表分割 Build Python
25 视觉语言模型(ViT-MLP-LLM) Build Python
26 单目深度与几何估计 Build Python
27 多目标跟踪与视频记忆 Build Python
28 世界模型与视频扩散 Build Python

Phase 5 — NLP:从基础到进阶  29 lessons  语言是通往智能的接口。

# Lesson Type Lang
01 文本处理:分词、词干提取、词形还原 Build Python
02 词袋、TF-IDF 与文本表示 Build Python
03 词嵌入:从零实现 Word2Vec Build Python
04 GloVe、FastText 与子词嵌入 Build Python
05 情感分析 Build Python
06 命名实体识别(NER) Build Python
07 词性标注与句法分析 Build Python
08 文本分类——用于文本的 CNN 与 RNN Build Python
09 序列到序列模型 Build Python
10 注意力机制——那次突破 Build Python
11 机器翻译 Build Python
12 文本摘要 Build Python
13 问答系统 Build Python
14 信息检索与搜索 Build Python
15 主题建模:LDA、BERTopic Build Python
16 文本生成 Build Python
17 聊天机器人:从规则到神经网络 Build Python
18 多语言 NLP Build Python
19 子词分词:BPE、WordPiece、Unigram、SentencePiece Learn Python
20 结构化输出与约束解码 Build Python
21 自然语言推理与文本蕴含 Learn Python
22 嵌入模型深入剖析 Learn Python
23 RAG 的分块策略 Build Python
24 指代消解 Learn Python
25 实体链接与消歧 Build Python
26 关系抽取与知识图谱构建 Build Python
27 LLM 评估:RAGAS、DeepEval、G-Eval Build Python
28 长上下文评估:NIAH、RULER、LongBench、MRCR Learn Python
29 对话状态跟踪 Build Python

Phase 6 — 语音与音频  17 lessons  听见、听懂、开口说。

# Lesson Type Lang
01 音频基础:波形、采样、FFT Learn Python
02 频谱图、梅尔刻度与音频特征 Build Python
03 音频分类 Build Python
04 语音识别(ASR) Build Python
05 Whisper:架构与微调 Build Python
06 说话人识别与验证 Build Python
07 文本转语音(TTS) Build Python
08 声音克隆与音色转换 Build Python
09 音乐生成 Build Python
10 音频语言模型 Build Python
11 实时音频处理 Build Python
12 搭一条语音助手流水线 Build Python
13 神经音频编解码器——EnCodec、SNAC、Mimi、DAC Learn Python
14 语音活动检测与轮次切换 Build Python
15 流式语音到语音——Moshi、Hibiki Learn Python
16 语音防伪与音频水印 Build Python
17 音频评估——WER、MOS、MMAU、排行榜 Learn Python

Phase 7 — Transformer 深入剖析  16 lessons  那个改变了一切的架构。

# Lesson Type Lang
01 为什么用 Transformer:RNN 的问题 Learn Python
02 从零实现自注意力 Build Python
03 多头注意力 Build Python
04 位置编码:正弦、RoPE、ALiBi Build Python
05 完整的 Transformer:编码器 + 解码器 Build Python
06 BERT——掩码语言建模 Build Python
07 GPT——因果语言建模 Build Python
08 T5、BART——编码器-解码器模型 Learn Python
09 Vision Transformer(ViT) Build Python
10 音频 Transformer——Whisper 架构 Learn Python
11 专家混合(MoE) Build Python
12 KV Cache、Flash Attention 与推理优化 Build Python
13 缩放定律 Learn Python
14 从零构建一个 Transformer Build Python
15 Attention 变体——滑动窗口、稀疏、差分 Build Python
16 投机解码——草稿、验证、重复 Build Python

Phase 8 — 生成式 AI  15 lessons  生成图像、视频、音频、3D,等等。

# Lesson Type Lang
01 生成模型:分类与历史 Learn Python
02 自编码器与 VAE Build Python
03 GAN:生成器 vs 判别器 Build Python
04 条件 GAN 与 Pix2Pix Build Python
05 StyleGAN Build Python
06 扩散模型——从零实现 DDPM Build Python
07 潜在扩散与 Stable Diffusion Build Python
08 ControlNet、LoRA 与条件控制 Build Python
09 图像修复、扩展与编辑 Build Python
10 视频生成 Build Python
11 音频生成 Build Python
12 3D 生成 Build Python
13 Flow Matching 与 Rectified Flow Build Python
14 评估:FID、CLIP Score Build Python
19 视觉自回归建模(VAR):下一尺度预测 Build Python

Phase 9 — 强化学习  12 lessons  RLHF 和会玩游戏的 AI 的基石。

# Lesson Type Lang
01 MDP、状态、动作与奖励 Learn Python
02 动态规划 Build Python
03 蒙特卡洛方法 Build Python
04 Q-Learning、SARSA Build Python
05 深度 Q 网络(DQN) Build Python
06 策略梯度——REINFORCE Build Python
07 Actor-Critic——A2C、A3C Build Python
08 PPO Build Python
09 奖励建模与 RLHF Build Python
10 多智能体强化学习 Build Python
11 仿真到现实的迁移 Build Python
12 游戏中的强化学习 Build Python

Phase 10 — 从零实现 LLM  24 lessons  构建、训练并真正理解大语言模型。

# Lesson Type Lang
01 分词器:BPE、WordPiece、SentencePiece Build Python, Rust
02 从零实现一个分词器 Build Python
03 预训练的数据流水线 Build Python
04 预训练一个迷你 GPT(124M) Build Python
05 分布式训练、FSDP、DeepSpeed Build Python
06 指令微调——SFT Build Python
07 RLHF——奖励模型 + PPO Build Python
08 DPO——直接偏好优化 Build Python
09 Constitutional AI 与自我改进 Build Python
10 评估——基准与 evals Build Python
11 量化:INT8、GPTQ、AWQ、GGUF Build Python
12 推理优化 Build Python
13 搭一条完整的 LLM 流水线 Build Python
14 开源模型:架构逐一拆解 Learn Python
15 投机解码与 EAGLE-3 Build Python
16 差分注意力(V2) Build Python
17 原生稀疏注意力(DeepSeek NSA) Build Python
18 多 token 预测(MTP) Build Python
19 DualPipe 并行 Learn Python
20 DeepSeek-V3 架构拆解 Learn Python
21 Jamba——SSM-Transformer 混合架构 Learn Python
22 异步与 Hogwild! 推理 Build Python
25 推测解码与 EAGLE Build Python
34 梯度检查点与激活重算 Build Python

Phase 11 — LLM 工程  17 lessons  让 LLM 在生产环境里干活。

# Lesson Type Lang
01 提示工程:技巧与套路 Build Python
02 Few-Shot、CoT、Tree-of-Thought Build Python
03 结构化输出 Build Python
04 嵌入与向量表示 Build Python
05 上下文工程 Build Python
06 RAG:检索增强生成 Build Python
07 进阶 RAG:分块、重排 Build Python
08 用 LoRA 与 QLoRA 微调 Build Python
09 函数调用与工具使用 Build Python
10 评估与测试 Build Python
11 缓存、限流与成本 Build Python
12 护栏与安全 Build Python
13 构建一个生产级 LLM 应用 Build Python
14 模型上下文协议(MCP) Build Python
15 提示缓存与上下文缓存 Build Python
16 Agent 状态机——图、节点与检查点 Build Python
17 agent 框架的取舍 Learn Python

Phase 12 — 多模态 AI  25 lessons  跨模态地看、听、读、推理——从 ViT 的图块到操作电脑的 agent。

# Lesson Type Lang
01 Vision Transformer 与图块-token 原语 Learn Python
02 CLIP 与对比式视觉语言预训练 Build Python
03 BLIP-2 Q-Former 作为模态桥梁 Build Python
04 Flamingo 与门控交叉注意力 Learn Python
05 LLaVA 与视觉指令微调 Build Python
06 任意分辨率视觉——Patch-n'-Pack 与 NaFlex Build Python
07 开源权重 VLM 配方:真正要紧的是什么 Learn Python
08 LLaVA-OneVision:单图、多图、视频 Build Python
09 Qwen-VL 家族与动态 FPS 视频 Learn Python
10 InternVL3 原生多模态预训练 Learn Python
11 Chameleon 早融合纯 token Build Python
12 Emu3 用下一 token 预测做生成 Learn Python
13 Transfusion:自回归 + 扩散 Build Python
14 Show-o 离散扩散统一架构 Learn Python
15 Janus-Pro 解耦编码器 Build Python
16 MIO 任意到任意流式 Learn Python
17 视频语言时序定位 Build Python
18 百万 token 上下文下的长视频 Build Python
19 音频语言模型:从 Whisper 到 AF3 Build Python
20 Omni 模型:Thinker-Talker 流式 Build Python
21 具身 VLA:RT-2、OpenVLA、π0、GR00T Learn Python
22 文档与图表理解 Build Python
23 ColPali 视觉原生文档 RAG Build Python
24 多模态 RAG 与跨模态检索 Build Python
25 多模态 agent 与操作电脑(综合项目) Build Python

Phase 13 — 工具与协议  31 lessons  AI 与真实世界之间的接口,包括 Agent Skills 与无状态 MCP 的生产契约。

# Lesson Type Lang
01 工具接口 Learn Python
02 函数调用深入剖析 Build Python
03 并行与流式工具调用 Build Python
04 结构化输出 Build Python
05 工具 Schema 设计 Learn Python
06 MCP 基础 Learn Python
07 构建一个 MCP server Build Python
08 构建一个 MCP client Build Python
09 MCP 传输层 Learn Python
10 MCP 资源与提示 Build Python
11 MCP Sampling Build Python
12 MCP Roots 与 Elicitation Build Python
13 MCP 异步任务 Build Python
14 MCP Apps Build Python
15 MCP 安全 I——工具投毒 Learn Python
16 MCP 安全 II——OAuth 2.1 Build Python
17 MCP 网关与注册表 Learn Python
18 生产环境的 MCP 认证——iii 上的 DCR + JWKS Build Python
19 A2A 协议 Build Python
20 OpenTelemetry GenAI Build Python
21 LLM 路由层 Learn Python
22 Skills 与 Agent SDK Learn Python
23 综合项目——工具生态 Build Python
24 Skill 发现与渐进式披露 Build Python
25 Skill 调用与路由 Build Python
26 Skill 权限、沙箱与信任 Build Python
27 Skill 评测、打包与可移植性 Build Python
28 MCP 工具契约与内容 Build Python
29 MCP 可靠性、取消与流量控制 Build Python
30 MCP Registry 供应链:准入、漂移与回滚 Build Python
31 MCP 一致性工程:版本、证据与运维 Build Python

模型上下文协议(MCP)路径包含第 06–18、28–31 课,共 17 节必修课,按清单顺序学习,其中第 18 课先于第 17 课。Agent Skills 路径包含第 22、24–27 课,共 5 节必修课。第 23 课是两条路径的可选系统综合项目,开始前按各路径清单完成前置要求。

Phase 14 — Agent 工程  54 lessons  从第一性原理构建 agent,可靠使用 coding agent,并在实现前把工作定义清楚。

# Lesson Type Lang
01 Agent 循环 Build Python
02 ReWOO 与 Plan-and-Execute Build Python
03 Reflexion 与言语强化学习 Build Python
04 Tree of Thoughts 与 LATS Build Python
05 Self-Refine 与 CRITIC Build Python
06 工具使用与函数调用 Build Python
07 Agent 记忆——虚拟上下文与记忆分页 Build Python
08 记忆块与休眠时计算 Build Python
09 混合记忆——向量 + 图 + KV Build Python
10 技能库与终身学习——Voyager Build Python
11 用 HTN 与进化搜索做规划 Build Python
12 Anthropic 的工作流模式 Build Python
13 有状态图编排——持久执行与检查点 Build Python
14 Agent 的 Actor 模型——异步消息与类型化运行时 Build Python
15 基于角色的 Agent 团队——角色、任务与流程 Build Python
16 OpenAI Agents SDK——交接、护栏、追踪 Build Python
17 Harness 即库——子 agent 与会话存储 Build Python
18 生产级 Agent 运行时——快速实例化与类型化工作流 Learn Python
19 基准——SWE-bench、GAIA、AgentBench Learn Python
20 基准——WebArena 与 OSWorld Learn Python
21 操作电脑——Claude、OpenAI CUA、Gemini Build Python
22 语音 agent——Pipecat 与 LiveKit Build Python
23 OpenTelemetry GenAI 语义约定 Build Python
24 Agent 可观测性——Langfuse、Phoenix、Opik Learn Python
25 多 agent 辩论与协作 Build Python
26 失败模式——agent 为什么会崩 Build Python
27 提示注入与 PVE 防御 Build Python
28 编排模式——Supervisor、Swarm、分层 Build Python
29 生产级运行时——队列、事件、Cron Learn Python
30 Eval 驱动的 agent 开发 Build Python
31 Agent 工作台:能力强的模型为什么仍会失败 Learn Python
32 最小化 agent 工作台 Build Python
33 把 agent 指令写成可执行约束 Build Python
34 仓库记忆与持久化状态 Build Python
35 给 agent 的初始化脚本 Build Python
36 范围契约与任务边界 Build Python
37 运行时反馈回路 Build Python
38 验证关卡 Build Python
39 审查 agent:把构建者和评判者分开 Build Python
40 多会话交接 Build Python
41 在真实仓库上跑工作台 Build Python
42 综合项目:交付一套可复用的 agent 工作台包 Build Python
43 在 agent 写代码前框定任务 Build Python
44 制定由证据支撑的执行计划 Build Python
45 通过隔离与合并契约委派 agent 工作 Build Python
46 把每次 agent 纠正变成系统改进 Build Python
47 在选择产出前定义结果 Build Python
48 发现人们实际执行的工作流 Build Python
49 绘制假设地图,先化解风险最高的一项 Build Python
50 选择能改变决定的最小可测试切片 Build Python
51 编写保留判断空间的规格说明 Build Python
52 在结果出现前设计成功指标 Build Python
53 有意识地选择原型、试点或生产 Build Python
54 构建带所有权与淘汰机制的反馈棘轮 Build Python

第 31-46 课组成 Agent 辅助工程路径。其清单顺序结合了工作台基础与任务框定、执行计划、隔离委派及长效反馈机制。第 47-54 课组成 产品判断与交付路径,涵盖从结果定义、事实证据、假设风险、切片选择、可执行规格说明到分阶段发布与反馈所有权的完整闭环。阶段 14 里每节工作台课程(31-42)都附带一份 mission.md,在 agent 打开完整课程文档前先给它做简报。

Phase 15 — 自主系统  22 lessons  长程 agent、自我改进,以及 2026 年的安全技术栈。

# Lesson Type Lang
01 从聊天机器人到长程 agent(METR) Learn Python
02 STaR、V-STaR、Quiet-STaR:自学推理 Learn Python
03 AlphaEvolve:进化式编码 agent Learn Python
04 Darwin Gödel Machine:自我修改的 agent Learn Python
05 AI Scientist v2:研讨会级别的科研 Learn Python
06 自动化对齐研究(Anthropic AAR) Learn Python
07 递归式自我改进:能力 vs 对齐 Learn Python
08 有界自我改进的设计 Learn Python
09 自主编码 agent 全景(SWE-bench、CodeAct) Learn Python
10 自主 Agent 的权限模式 Learn Python
11 浏览器 agent 与间接提示注入 Learn Python
12 长时运行 agent 的持久化执行 Learn Python
13 动作预算、迭代上限、成本管控 Learn Python
14 急停开关、熔断器、金丝雀 token Learn Python
15 人在回路:先提议后提交 Learn Python
16 检查点与回滚 Learn Python
17 Constitutional AI 与规则覆盖 Learn Python
18 Llama Guard 与输入/输出分类 Learn Python
19 Anthropic 负责任扩展政策 v3.0 Learn Python
20 OpenAI Preparedness 框架与 DeepMind FSF Learn Python
21 METR 时间跨度与外部评估 Learn Python
22 CAIS、CAISI 与社会规模风险 Learn Python

Phase 16 — 多 agent 与集群  25 lessons  协调、涌现,以及集体智能。

# Lesson Type Lang
01 为什么要多 agent Learn TypeScript
02 FIPA-ACL 传承与言语行为 Learn Python
03 通信协议 Build TypeScript
04 多 agent 原语模型 Learn Python
05 Supervisor / 编排者-worker 模式 Build Python
06 分层架构与分解漂移 Learn Python
07 心智社会与多 agent 辩论 Build Python
08 角色专精——规划者 / 批评者 / 执行者 / 验证者 Build Python
09 并行集群与网络化架构 Build Python
10 群聊与发言人选择 Build Python
11 交接与例程(无状态编排) Build Python
12 A2A——Agent 到 Agent 协议 Build Python
13 共享记忆与黑板模式 Build Python
14 共识与拜占庭容错 Build Python
15 投票、自洽性与辩论拓扑 Build Python
16 协商与议价 Build Python
17 生成式 agent 与涌现式仿真 Build Python
18 心智理论与涌现式协调 Build Python
19 群体优化(PSO、ACO) Build Python
20 MARL——MADDPG、QMIX、MAPPO Learn Python
21 Agent 经济、token 激励、声誉 Learn Python
22 生产级扩展——队列、检查点、持久性 Build Python
23 失败模式——MAST、群体思维、单一文化 Learn Python
24 评估与协调基准 Learn Python
25 案例研究与 2026 最新进展 Learn Python

Phase 17 — 基础设施与生产  28 lessons  把 AI 交付到真实世界。

# Lesson Type Lang
01 托管 LLM 平台 — Bedrock、Azure OpenAI、Vertex AI Learn Python
02 推理平台经济学 — Fireworks、Together、Baseten、Modal Learn Python
03 Kubernetes 上的 GPU 自动扩缩 — Karpenter、KAI Scheduler Learn Python
04 推理服务引擎内部机制——PagedAttention、连续批处理与分块预填充 Learn Python
05 生产环境中的 EAGLE-3 推测解码 Learn Python
06 前缀缓存推理服务——RadixAttention 与 KV 复用 Learn Python
07 硬件专用推理编译——Blackwell 上的 FP8 与 NVFP4 Learn Python
08 推理指标 — TTFT、TPOT、ITL、Goodput、P99 Learn Python
09 生产级量化 — AWQ、GPTQ、GGUF、FP8、NVFP4 Learn Python
10 无服务器 LLM 的冷启动缓解 Learn Python
11 多区域 LLM 服务与 KV 缓存局部性 Learn Python
12 边缘推理 — ANE、Hexagon、WebGPU、Jetson Learn Python
13 LLM 可观测性技术栈选型 Learn Python
14 提示缓存与语义缓存的经济学 Learn Python
15 批处理 API — 50% 折扣作为行业标准 Learn Python
16 把模型路由作为降本原语 Learn Python
17 预填充/解码分离 — NVIDIA Dynamo 与 llm-d Learn Python
18 生产级推理服务栈——KV 卸载与缓存感知路由 Learn Python
19 AI 网关 — LiteLLM、Portkey、Kong、Bifrost Learn Python
20 影子、金丝雀与渐进式部署 Learn Python
21 LLM 功能的 A/B 测试 — GrowthBook 与 Statsig Learn Python
22 LLM API 的负载测试 — k6、LLMPerf、GenAI-Perf Build Python
23 面向 AI 的 SRE — 多智能体事件响应 Learn Python
24 面向 LLM 生产的混沌工程 Learn Python
25 安全 — 密钥、PII 脱敏、审计日志 Learn Python
26 合规 — SOC 2、HIPAA、GDPR、EU AI Act、ISO 42001 Learn Python
27 面向 LLM 的 FinOps — 单位经济与多租户归因 Learn Python
28 自托管推理服务选型——让引擎匹配硬件与规模 Learn Python

Phase 18 — 伦理、安全与对齐  30 lessons  构建对人类有益的 AI。这不是选修。

# Lesson Type Lang
01 把遵循指令当作对齐信号 Learn Python
02 奖励黑客与古德哈特定律 Learn Python
03 直接偏好优化家族 Learn Python
04 阿谀奉承:RLHF 的放大效应 Learn Python
05 Constitutional AI 与 RLAIF Learn Python
06 Mesa 优化与欺骗性对齐 Learn Python
07 潜伏 agent——持续性欺骗 Learn Python
08 前沿模型中的上下文内谋划 Learn Python
09 对齐造假 Learn Python
10 AI Control——即便被颠覆也保安全 Learn Python
11 可扩展监督与弱到强 Learn Python
12 红队:PAIR 与自动化攻击 Build Python
13 多样本越狱 Learn Python
14 ASCII 字符画与视觉越狱 Build Python
15 间接提示注入 Build Python
16 红队工具:Garak、Llama Guard、PyRIT Build Python
17 WMDP 与双用途能力评估 Learn Python
18 前沿安全框架——RSP、PF、FSF Learn Python
19 模型福祉研究 Learn Python
20 偏见与表征伤害 Build Python
21 公平性准则:群体、个体、反事实 Learn Python
22 面向 LLM 的差分隐私 Build Python
23 水印:SynthID、Stable Signature、C2PA Build Python
24 监管框架:欧盟、美国、英国、韩国 Learn Python
25 EchoLeak 与 AI 的 CVE Learn Python
26 模型卡、系统卡与数据集卡 Build Python
27 数据溯源与训练数据治理 Learn Python
28 对齐研究生态:MATS、Redwood、Apollo、METR Learn Python
29 内容审核系统:OpenAI、Perspective、Llama Guard Build Python
30 双用途风险:网络、生物、化学、核 Learn Python

Phase 19 — 综合项目  85 projects  端到端项目与组件实践,按目标选择;各课正文列出预计时长。

# Project Combines Lang
01 终端原生编码 agent P0 P5 P7 P10 P11 P13 P14 P15 P17 P18 Python
02 代码库 RAG(跨仓库语义搜索) P5 P7 P11 P13 P17 Python
03 实时语音助手(ASR → LLM → TTS) P6 P7 P11 P13 P14 P17 Python
04 多模态文档问答(视觉优先) P4 P5 P7 P11 P12 P17 Python
05 自主科研 agent(AI-Scientist 级别) P0 P2 P3 P7 P10 P14 P15 P16 P18 Python
06 面向 Kubernetes 的 DevOps 排障 agent P11 P13 P14 P15 P17 P18 Python
07 端到端微调流水线 P2 P3 P7 P10 P11 P17 P18 Python
08 生产级 RAG 聊天机器人(受监管垂直行业) P5 P7 P11 P12 P17 P18 Python
09 代码迁移 agent(仓库级升级) P5 P7 P11 P13 P14 P15 P17 Python
10 多 agent 软件工程团队 P11 P13 P14 P15 P16 P17 Python
11 LLM 可观测性与 Eval 仪表盘 P11 P13 P17 P18 Python
12 视频理解流水线(场景 → 问答) P4 P6 P7 P11 P12 P17 Python
13 带注册表与治理的 MCP server P11 P13 P14 P17 P18 Python
14 投机解码推理服务器 P3 P7 P10 P17 Python
15 Constitutional 安全测试架 + 红队靶场 P10 P11 P13 P14 P18 Python
16 GitHub Issue 到 PR 的自主 agent P11 P13 P14 P15 P17 Python
17 个人 AI 导师(自适应、多模态) P5 P6 P11 P12 P14 P17 P18 Python
20 Agent Harness Loop 契约 A. Agent harness Python
21 带 Schema 校验的 Tool Registry A. Agent harness Python
22 基于换行分隔 stdio 的 JSON-RPC 2.0 A. Agent harness Python
23 Function Call Dispatcher A. Agent harness Python
24 Plan-Execute 控制流 A. Agent harness Python
25 Verification Gate 与 Observation Budget A. Agent harness Python
26 带 Denylist 与 Path Jail 的 Sandbox Runner A. Agent harness Python
27 带 Fixture Tasks 的 Eval Harness A. Agent harness Python
28 用 OTel GenAI Span 与 Prometheus 做 Observability A. Agent harness Python
29 端到端 Coding Agent Demo A. Agent harness Python
30 从零实现 BPE Tokenizer B. NLP LLM Python
31 带 Sliding Window 的 Tokenized Dataset B. NLP LLM Python
32 Token Embedding 与 Positional Embedding B. NLP LLM Python
33 Multi-Head Self-Attention B. NLP LLM Python
34 从零实现 Transformer Block B. NLP LLM Python
35 GPT 模型组装 B. NLP LLM Python
36 训练循环与评估 B. NLP LLM Python
37 加载预训练权重 B. NLP LLM Python
38 通过换 Head 做分类微调 B. NLP LLM Python
39 通过 SFT 做 Instruction Tuning B. NLP LLM Python
40 从零实现 DPO B. NLP LLM Python
41 完整评估流水线 B. NLP LLM Python
42 大规模语料下载器 C. 端到端训练 Python
43 HDF5 Tokenized Corpus C. 端到端训练 Python
44 Cosine 学习率 + 线性 Warmup C. 端到端训练 Python
45 Gradient Clipping 与混合精度训练 C. 端到端训练 Python
46 梯度累积 C. 端到端训练 Python
47 Checkpoint 保存与恢复 C. 端到端训练 Python
48 从零实现分布式数据并行与 FSDP C. 端到端训练 Python
49 语言模型评测框架 C. 端到端训练 Python
50 假设生成器 D. 自动研究 Python
51 文献检索 D. 自动研究 Python
52 实验执行器 D. 自动研究 Python
53 结果评估器 D. 自动研究 Python
54 论文生成器 D. 自动研究 Python
55 评审循环 D. 自动研究 Python
56 迭代调度器 D. 自动研究 Python
57 端到端研究 Demo D. 自动研究 Python
58 Vision Encoder 的 Patch 切分 E. 多模态 Python
59 Vision Transformer Encoder(ViT) E. 多模态 Python
60 用 Projection Layer 做模态对齐 E. 多模态 Python
61 Cross-Attention 融合 E. 多模态 Python
62 Vision-Language 预训练 E. 多模态 Python
63 多模态评测 E. 多模态 Python
64 Chunking 策略横向对比 F. 高级 RAG Python
65 用 BM25 与 Dense Embedding 做 Hybrid Retrieval F. 高级 RAG Python
66 Cross-Encoder Reranker F. 高级 RAG Python
67 Query 改写:HyDE、Multi-Query 与 Decomposition F. 高级 RAG Python
68 RAG 评测:Precision、Recall、MRR、nDCG 等 F. 高级 RAG Python
69 端到端 RAG 系统 F. 高级 RAG Python
70 任务规格格式 G. 评测体系 Python
71 经典评测指标 G. 评测体系 Python
72 代码执行评测指标 G. 评测体系 Python
73 perplexity 与 calibration G. 评测体系 Python
74 leaderboard 聚合 G. 评测体系 Python
75 端到端 eval runner G. 评测体系 Python
76 从零实现集合通信 H. 分布式训练 Python
77 数据并行 DDP H. 分布式训练 Python
78 ZeRO Optimizer State 分片 H. 分布式训练 Python
79 Pipeline Parallel 与 Bubble 分析 H. 分布式训练 Python
80 分片 Checkpoint 与原子化恢复 H. 分布式训练 Python
81 端到端分布式训练 H. 分布式训练 Python
82 越狱分类法 I. 安全护栏 Python
83 Prompt 注入检测器 I. 安全护栏 Python
84 拒答评估 I. 安全护栏 Python
85 内容分类器集成 I. 安全护栏 Python
86 Constitutional 规则引擎 I. 安全护栏 Python
87 端到端 safety gate I. 安全护栏 Python
░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

工具箱

课程产物保存在各课的 phases///outputs/ 下,包含提示词 Markdown、 技能 Markdown、完整 skill bundle 和项目参考文件。各课正文的“拿去用”章节说明产物用途; 下面分别说明导师技能与课程产出技能的安装方式。

把课程产出技能装进你的 agent

仓库在 phases/**/outputs/ 下交付了 396 个技能和 99 个提示词。

导师技能:通过 skills.sh 选择安装。 默认发现 skills/ 下的 9 个导师技能:

npx skills add fancyboi999/ai-engineering-from-scratch-zh --list
npx skills add fancyboi999/ai-engineering-from-scratch-zh --skill start-learning

课程产出技能:克隆仓库后运行 scripts/install_skills.py。 脚本读取课程的 skill-*.md 和完整 skill bundle,支持按阶段或标签筛选。将 `` 替换为宿主的技能目录:

python3 scripts/install_skills.py                                  # 所有技能,默认 --layout skills(嵌套)
python3 scripts/install_skills.py  --layout skills                 # 同上,显式写出
python3 scripts/install_skills.py  --type all                      # 技能 + 提示词 + agent
python3 scripts/install_skills.py  --phase 14                      # 只装一个阶段
python3 scripts/install_skills.py  --tag rag                       # 按标签过滤
python3 scripts/install_skills.py  --layout flat                   # 扁平文件
python3 scripts/install_skills.py  --dry-run                       # 只预览,不写入
python3 scripts/install_skills.py  --force                         # 覆盖已有文件

`` 是你 agent 的技能目录(例如: ~/.claude/skills/、~/.cursor/skills/、~/.config/openclaw/skills/、 .skills/,或任何你 agent 读取的路径)。

默认情况下,脚本拒绝覆盖已存在的目标,会列出每个冲突路径后以退出码 1 退出。 用 --dry-run 预览冲突,或用 --force 覆盖。每次非 dry-run 的运行都会在目标里 写一份 manifest.json,按类型和阶段分组列出完整清单。挑你 agent 读取的那种布局:

--layout 写入路径
skills //SKILL.md(嵌套约定,Claude / Cursor / Codex / OpenClaw / Hermes 都支持)
by-phase /phase-NN/.md
flat /.md

把 agent 工作台塞进你自己的仓库

阶段 14 的综合项目交付了一套可复用的 Agent Workbench 包(AGENTS.md、schema、 init / verify / handoff 脚本)。用下面的命令把它脚手架进任意仓库:

python3 scripts/scaffold_workbench.py path/to/your-repo            # 完整包 + 种子文件
python3 scripts/scaffold_workbench.py path/to/your-repo --minimal  # 跳过 docs/
python3 scripts/scaffold_workbench.py path/to/your-repo --dry-run  # 只预览
python3 scripts/scaffold_workbench.py path/to/your-repo --force    # 覆盖

你会得到接好线的七个工作台界面、一份起步用的 task_board.json, 以及一份 schema_version: 1 的全新 agent_state.json。从这里开始:编辑任务、 编辑 AGENTS.md、运行 scripts/init_agent.py,把契约交给你的 agent。包的源码在 phases/14-agent-engineering/42-agent-workbench-capstone/outputs/agent-workbench-pack/。

课程数据与课数校验

site/build.js 解析 README、ROADMAP 和每节课的 docs/zh.md,在 site/data.js 里生成站点用的课程数据(阶段、课程、术语表、产物)。计数以文件系统为真相。

node site/build.js            # 生成 site/data.js(+ sitemap.xml / llms.txt)
node site/build.js --check    # 只校验课程数一致性,不写文件

--check 以磁盘上的课程目录数为准,核对 README 表格、badge、散文、各 phase 标题 和 ROADMAP 总计是否都对得上,任一漂移就 exit 1。一个 GitHub Action (.github/workflows/build.yml)在每个 PR 上跑构建与课数校验。 新增课程时在 README + ROADMAP 表格补行、并更新该 phase 标题的课数即可;站点模板里散落的计数由 build 时 syncCounts 自动同步。

注:scripts/build_catalog.py 也已支持 docs/zh.md,但 catalog.json 只是可再生的辅助产物; 中文站发布与课程计数仍以 site/build.js、scripts/audit_lessons.py 和 README / ROADMAP 为准。

给每节课的 Python 代码做冒烟检查

scripts/lesson_run.py 会逐字节编译每节课 code/ 目录下的每个 .py 文件。 默认模式只做语法检查——不执行、不需要 API key、不需要重型 ML 依赖。专抓贡献者最常 引入的回归(缩进错误、f-string 写坏、误改)。

python3 scripts/lesson_run.py                  # 语法检查整套课程
python3 scripts/lesson_run.py --phase 14       # 只查一个阶段
python3 scripts/lesson_run.py --json           # 在 stdout 输出 JSON 报告
python3 scripts/lesson_run.py --strict         # 任一课程失败就 exit 1
python3 scripts/lesson_run.py --execute        # 真正运行,每节课 10 秒超时

--execute 会运行每节课的 code/main.py(或第一个 .py 文件),10 秒超时。 入口文件开头带 # requires: pkg1, pkg2 注释(列出非标准库依赖)的课程会被跳过, 原因标为 needs 。这个脚本是可选的,没接入 CI。

仅用标准库,Python 3.10+。设置 LINK_CHECK_SKIP=domain1,domain2 可以覆盖默认跳过名单 (twitter.com、x.com、linkedin.com、instagram.com、medium.com——这些域名 会主动屏蔽自动化的 HEAD/GET)。

从哪里开始

你的背景 从哪开始 学习范围
编程和 AI 都是新手 阶段 0 — 配置与工具链 先准备环境,再按前置依赖学习
会 Python,刚接触 ML 阶段 1 — 数学基础 数学与机器学习基础
懂 ML,刚接触深度学习 阶段 3 — 深度学习核心 神经网络与训练
懂深度学习,想学 LLM 和 agent 阶段 10 — 从零实现 LLM 模型、应用与 agent
资深工程师,只想要 agent 工程 阶段 14 — Agent 工程 按目标选择工程课程与综合项目
只想构建生产级 MCP 系统 模型上下文协议(MCP)路径 17 节必修,约 23 小时 15 分
只想构建生产级 Agent Skills Agent Skills 工程路径 5 节必修,约 9 小时 30 分

ROADMAP.md 按各课正文汇总预计时长。阶段 0–18 的 438 节课合计约 542 小时; 阶段 19 的 85 项综合项目与组件实践合计约 627 小时,适合按目标选做。 专项路径以 learning-paths/*.json 的必修清单和时长为准。实际投入取决于基础、实验环境和项目深度。

░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

为什么这件事现在很重要

FIG_003 · A
THE INDUSTRY SIGNAL

FIG_003 · B
FOUNDATIONAL PAPERS COVERED

"最热门的新编程语言,是英语。"

— Andrej Karpathy (tweet)

课程围绕可运行的实现组织学习:阅读论文与规范,构建最小示例,再用测试和产物检查理解。

  • Attention Is All You Need — Vaswani et al., 2017 → Phase 7
  • Language Models are Few-Shot Learners (GPT-3) → Phase 10
  • Denoising Diffusion Probabilistic Models → Phase 8
  • InstructGPT / RLHF → Phase 10
  • Direct Preference Optimization → Phase 10
  • Chain-of-Thought Prompting → Phase 11
  • ReAct: Reasoning + Acting in LLMs → Phase 14
  • Model Context Protocol — Anthropic → Phase 13
░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒░░░▒▒▒

参与贡献

Goal Read
贡献一节课或一处修复 CONTRIBUTING.md
为你的团队或学校 fork FORKING.md
课程模板 LESSON_TEMPLATE.md
跟踪进度 ROADMAP.md
术语表 glossary/terms.md
行为准则 CODE_OF_CONDUCT.md

提交一节课之前,先跑一遍不变量检查:

python3 scripts/audit_lessons.py           # 整套课程
python3 scripts/audit_lessons.py --phase 14  # 单个阶段
python3 scripts/audit_lessons.py --json    # 适合 CI 的输出

任一规则失败时退出码非零。规则(L001–L010)会校验目录结构、docs/zh.md 是否存在 及是否有 H1、code/ 是否非空、quiz.json 的 schema,以及课程文档里的相对链接。

Star 历史

Star history

如果这份手册帮到了你,给仓库点个 star。这能让项目活下去。

许可

采用 MIT 许可,允许使用、修改和商业分发。分发副本或实质性部分时,须保留版权声明和许可声明。

原课程由 Rohit Ghumare 及社区创建,简体中文版由 fancy 维护。

aieng-zh.cn  ·  Report / Suggest