📑 本页目录(点开跳转)
00 · 如何使用本教程(ADHD 版)
⏱ 20 分钟 | 🎁 可以跳过,但读了能省后面几十小时
🎯 一句话
这一节不讲 Agent,讲怎么让你真的学完它。如果你已经读过《推荐算法》教程的第 00 节,规则一样,扫一眼下面的「本教程特有的三件事」就够了。
🧭 为求职准备,先按目标进入
| 目标 | 已存在的第一站 | 后续产出 |
|---|---|---|
| 从零开始理解 Agent | 01 · 第一个 Agent | 看懂循环与工具调用 |
| 企业知识库 / RAG | 11b · 文档入库 | 检索对照、引用诊断与权限负例 |
| MCP / 工具平台 | 08c · 鉴权与互操作 | 真实协议测试与宿主接入 |
| 可交付的完整项目 | 17b · 企业知识助手 | 代码、评测、审批恢复与运行验收 |
| 模型训练或推理岗位 | 17c · 岗位专项 | 按 JD 补专项实验 |
🧠 这套教程和普通教程的区别
普通 AI 教程的三个坑,这里都做了针对性处理:
| 普通教程的坑 | 本教程的做法 |
|---|---|
| 前三章全是概念,没有产出 | 第 1 节 10 分钟就跑出一个真的 Agent,不用 API Key 也能跑 |
| 一章 50 页,走神了不知道从哪回来 | 按目标分段,有 🛑 停靠点与 ⚡走神救援(短要点恢复状态) |
| 默认你记得前面讲了什么 | 每节自包含,开头 🎯一句话 给全节精华 |
| 只讲成功路径,不讲怎么排查 | 每章都有 ⚠️坑表,讲真实会踩的错误和症状 |
🔧 标记系统(和其他教程一致)
| 标记 | 意思 |
|---|---|
| ⏱ | 参考节奏;可按停靠点分次完成,不是页面长度限制 |
| 🎯 一句话 | 只看这个也能懂 60% |
| ⭐ / 🎁 | 核心不能跳 / 加餐随便跳 |
| 🔨 动手 | 有代码,复制去跑,别只看 |
| ⚠️ 坑 | 真实会踩的错误 |
| 💡 人话翻译 | 概念的白话版 |
| 🔗 和站内其他章的关系 | 这块知识和站里别的章怎么接 |
| ✅ 检查点 | 答案折叠着,先自己想 |
| 🛑 可以停 | 天然断点,停这不亏 |
| ⚡ 走神救援 | 隔天回来只读这个,别重读全文 ⭐ |
| 📚 延伸阅读 | 想看更细的原始材料时点进去 |
⭐ 「走神救援」是这套教程里最该用的功能: 它是整章浓缩成的一段话,30 秒就能把上下文接回来。
❌ 错误的做法:三天后回来,从第 1 节重新读 ✅ 正确的做法:读上一节的走神救援,直接进下一节
📌 本教程特有的三件事
1. 它和站内其他教程的分工
信息关系
⭐ 一个重要的定位:这套教程是"应用层",不需要你懂模型内部。 你完全可以在不知道什么是注意力机制的情况下学完它并做出东西。 (好奇的话再去看全景导论主线 2 · 模型怎样看懂一句话。)
2. 你需要一点 Python,但只要一点
会 def、dict、for 就可以开始。后面的工程实践会继续用到异常、类型、异步、数据库事务、测试与命令行;遇到时沿链接补,不把“会调用 API”当成全教程的能力上限。
# 独立可运行:先用可控模型响应理解输入输出。
def call_model(messages):
return {"role": "assistant", "content": "收到:" + messages[-1]["content"]}
print(call_model([{"role": "user", "content": "你好"}]))
💡 没有 API Key 也能学:第 1 节的代码用一个「假模型」就能跑通全部机制。 零成本,而且假模型反而让你看得更清楚——因为你能控制它返回什么。
3. 时效性警告 ⚠️
Agent 领域比推荐系统变得还快。方法论比参数持久:
| 会过期的 | 长期有效的 |
|---|---|
| 某模型的 token 上限是多少 | 「上下文是有限预算」这个原则 |
| 哪个框架最流行 | Agent 循环的结构 |
| 具体的 API 参数名 | 工具设计的原则(ACI) |
| 当前最强模型是谁 | 「先简单再复杂」的降级测试 |
每章先教长期有效的机制,具体 API 配套版本与实测。看到具体数字时,记住它是「量级感」不是「当前值」。
⏲️ 学习节奏(ADHD 版四规则)
① 10 分钟番茄起步
番茄钟是用来启动的,不是用来打断的。 进入状态就别停。 ADHD 大脑最难的是「开始」,不是「持续」——所以门槛要设得极低。
② 一天最多两节,看完起来走一圈
连着塞四节的真实结果是后两节完全没进脑子,而且第二天不想打开了。
③ 卡住就记欠账
看不懂的记下来继续走,超过 5 条再回头补。 这个领域前面的洞后面会自动补上——很多"第 3 节没懂的东西",第 7 节自然就通了。
要点
欠账本(在这写):
1.
2.
3.
④ 每节做完那个 🔨 动手环节
这是四条里最重要的一条。
对照
❌ "我看懂了这个循环怎么工作"
✅ "我跑了一遍,看到它在第 3 轮调了 search 工具"
⭐ 判断标准:如果你说得出结论却说不出"我跑出来是什么",
那一节其实没学
💡 对 ADHD 特别有效的一点:跑代码有即时反馈。 读三页文字得不到任何多巴胺,跑一段代码看到输出就有—— 把学习拆成一段段"能立刻看到结果"的动作,比靠意志力有用得多。
🚫 本领域特有的陷阱
| 陷阱 | 为什么是陷阱 | 替代做法 |
|---|---|---|
| 先学完 LangChain/框架再说 | 框架把机制藏起来了,出问题你不知道在哪 | 本教程教你徒手造轮子(第 1、18 节),懂了原理任何框架都是一层皮 |
| 收集 100 个 Prompt 模板 | 模板会过期,且不告诉你"为什么这么写" | 学第 3 节的原则就够 |
| 没有 API Key 就不开始 | 这是最常见的拖延借口 | 第 1 节用「假模型」跑通全部机制,零成本 |
| 追新闻(今天 X 发布了 Y!) | 新闻是多巴胺陷阱 ⭐ | 每章的方法论半年后依然成立。看新闻的时间用来跑一段代码 |
| 一上来就做多 Agent | 多 Agent 的复杂度是指数级的 | 先把单 Agent 做扎实(第 13 节会告诉你什么时候才真的需要多 Agent) |
🔑 最后一条值得展开:很多人被"多 Agent 协作"的概念吸引, 但绝大多数任务用一个 Agent + 好的工具设计就能做。 过早引入多 Agent,你会同时面对"单 Agent 还没做好"和"协作出问题"两个难题。
🗺️ 全教程结构
对照
【阶段1】跑起来 01-02 ← 10 分钟造出第一个 Agent
【阶段2】三大基本功 03-05 ← 提示词 / 上下文 / 04b 记忆 / Claude Code 实操
【阶段3】能力扩展 06-11 ← 工作流决策 / 工具 / MCP / GUI 操作 / Skills / RAG
【阶段4】规模化 12-14 ← Harness / 多 Agent / 评测
【阶段5】上生产 15-16c ← 安全 / 企业落地(循环工程在这一章里)
/ 16b 框架这层皮 / 16c 接进真实产品
【阶段6】动手 17 ← 三个实战项目,挑一个做
【阶段7】终极挑战 18-20 ← 手搓框架 / 评测驱动 / 提示注入攻防
【随时查】 附录A 术语 / 附录B 上线清单
两节是全教程的核心,别跳:
| 章节 | 为什么 |
|---|---|
| ⭐ 第 4 节 上下文工程 | 理解后面一切的钥匙——工具、RAG、Harness、多 Agent 全都在解决同一个问题 |
| ⭐ 第 14 节 评测 | 不会评测,你所有的"改进"都是感觉 |
📌 04b · Agent 记忆 是第 4 节的续集,用不用取决于你要做什么:
做一次性任务(一轮问答、一次代码修改)——可以先跳过,第 4 节的上下文工程够用了。
做跨会话的东西(助理、客服、长期陪伴你的编码 Agent)——⭐ 别跳,而且要在做第 11 节 RAG 之前先看。
原因很实际:RAG 和 Memory 的检索那一半是同一套,写入那一半完全不同, ⚠️ 先学了 RAG 的人极容易把 Memory 当成「RAG 换个名字」直接开做, 然后在「该记什么」「新旧冲突谁赢」「怎么忘」这三件事上全部返工。
📌 阶段 5 末尾那两章最容易被忽略,但它们是全教程最长的两章(合计 134 分钟), 而且要不要读取决于你打算走到哪一步:
16b · 框架这层皮(54 分钟)一行 API 都不写, 它做的是把 LangGraph / CrewAI 这些你上班第一周就会撞见的名字,一个一个对回前面讲过的机制—— 只想自己搭东西可以先跳,要进团队接别人的代码就别跳。
⭐ 16c · 接进真实产品(80 分钟)反过来:用不用框架都躲不掉。 结构化输出、流式输出、护栏这三件事没有任何框架能替你做完, 只要你打算把 Demo 交给真实用户,它就是必读的那一章。
✅ 检查点
- 📚 和 ⚡ 两个标记分别是什么意思?
- 走神回来该看哪个区块?错误的做法是什么?
- 这套教程需要你懂模型内部原理吗?
- 没有 API Key 能不能学?为什么"假模型"反而看得更清楚?
- 学习节奏四规则里最重要的是哪一条?判断"学没学会"的标准是什么?
- 为什么"一上来就做多 Agent"是陷阱?
- 哪两节是全教程核心?
👀 答案
- 📚 = 延伸阅读(想看更细的原始材料时点进去);⚡ = 走神救援(整章浓缩成一段话,中断后 30 秒接回上下文)。
- 看 ⚡走神救援。错误的做法是从头重读——那是最容易让人放弃整套教程的做法。
- 不需要。这套教程是应用层,你完全可以在不知道注意力机制的情况下学完并做出东西。好奇再去看全景导论主线 2「模型怎样看懂一句话」。
- 能。第 1 节用「假模型」就能跑通全部机制。假模型更清楚是因为你能控制它返回什么,所以能精确观察循环的每一步行为。
- ④ 每节做完动手环节。判断标准:说得出结论却说不出"我跑出来是什么",那一节其实没学。跑代码还有即时反馈,对 ADHD 特别有效。
- 因为多 Agent 的复杂度是指数级的,而绝大多数任务用一个 Agent + 好的工具设计就够。过早引入会让你同时面对"单 Agent 没做好"和"协作出问题"两个难题。
- 第 4 节上下文工程(理解后面一切的钥匙)和第 14 节评测(不会评测所有"改进"都是感觉)。
🛑 到这就够了
⚡ 走神救援
先记住这几件事
- 先用假模型跑通一次工具循环,没有 API Key 也能开始。
- 中断后从走神救援和上一次运行结果接回,不必从头重读。
- 先掌握上下文和评测,再按真实需求补工具、框架与生产能力。
现在做一件事:设 10 分钟闹钟,打开 👉 01-第一天-10分钟造出你的第一个Agent.md