🏠 总目录📚 本教程 00 · 怎么用这份教程
📑 本页目录(点开跳转)

00 · 怎么用这份教程

26 分钟 | 🧭 读完这 9 分钟,能省下好几个小时的白读


🎯 一句话

这套教程讲的是:多个有自己想法的人凑在一起,会发生什么,以及规则该怎么设计。

它和站里其他几套的关系很简单: 别的教程默认「对面不会算计你」,这一套讲那个假设不成立时的世界。


👤 一、这套适合谁

你的情况 建议
想搞懂拍卖 / 竞价 / 撮合 / 分配这类系统底下是什么 正中靶心
在准备算法博弈论、计算社会选择、多智能体系统的考试 ✅ 覆盖完整,每章都有可手算的例子
做推荐、广告、交易、平台策略 ✅ ⭐ 你天天面对的就是「用户和商家都会算计平台」的局面
想理解 SHAP、多目标优化的帕累托前沿这些词的出处 ✅ 那些概念的老家在这里
只想训好一个模型 ⛔ 用不上,去看《机器学习与深度学习基础》

需要的前置:会加减乘除、能看懂一张表格。⭐ 不需要微积分、线性代数、编程。 用到概率的地方只有「期望 = 概率 × 数值再相加」这一条,第 8 章会现场讲。


⏱ 二、要花多少时间(真实数字)

全部正文加起来约 16.4 小时。 分段是这样的:

板块 章节 时长 能不能跳
逻辑地基 02–06 2.6 小时 ⭐⭐ 能整段跳过,见下一节
一个人怎么算理性 07–08 1.3 小时 不能,是全部的地基
非合作博弈 09–15 4.5 小时 核心中的核心
机制设计与匹配 16–18 1.8 小时 想懂拍卖/撮合必读
公平分配 19–21 2.3 小时 可选,但 19 值得看
合作博弈 22–23 1.3 小时 ⭐ 23 章 Shapley 用途极广
社会选择 24–26 2.1 小时 ⭐ 26 章是全套的思想高潮

⚠️ 这些数字是按 170 字/分钟量出来的,不是拍脑袋写的。 标少了比不标更糟 —— 你会中途弃坑,而且从此不信这个数。如果你读得比这慢,那是正常的, 这些章的密度比一般教程高。


✂️ 三、⭐ 最重要的一条:逻辑那五章可以整段跳过

02–06 章(命题逻辑、模型集、分辨率、一阶逻辑)和后面 20 章是独立的。

第 7 章直接开始,不会缺任何前置知识

你的目的 要不要读 02–06
想学博弈论、拍卖、投票 跳过,直接去第 7 章
想搞懂 SAT 求解器 / 形式化验证 / 定理证明 ✅ 读,那是这五章的正主
想知道「知识图谱推理」底下是什么 ✅ 读,尤其第 6 章一阶逻辑
课程考试要考 ✅ 读

为什么把它们放在前面还允许跳过:源课程(UNSW COMP4418)叫「知识表示与推理」, 逻辑是它的另外半门课。内容值得保留,但它不该挡住想学博弈论的人。


🗺️ 四、四条读法

🚀 路线 A:只想懂博弈论(推荐给大多数人,约 6 小时)

07 偏好与效用 → 08 期望效用 → 09 正常形博弈 → 10 支配策略
   → 11 纳什均衡 ⭐⭐ → 12 混合策略 → 13 零和与极大极小

第 11 章是整套的枢纽,读到那里你就算入门了。 14–15(扩展式博弈、拥塞博弈)可以之后再补。

💰 路线 B:做平台/广告/撮合的(约 5 小时)

07 → 09 → 11 → 16 机制设计 ⭐⭐ → 17 稳定匹配 → 18 TTC
   → 顺手看《推荐算法》15b 广告:从推荐到竞价

第 16 章是转折点:从「预测会发生什么」翻转成「设计让什么发生」。 它的工业落点就在《推荐算法》15b

🗳️ 路线 C:只关心投票与集体决策(约 2.5 小时)

07 → 24 投票规则 → 25 Condorcet 与锦标赛解 → 26 不可能定理 ⭐⭐

⭐ 这条线最短、思想冲击最大第 26 章可能是全站最值得读的一章。

📚 路线 D:完整走一遍(16 小时)

按 00 → 01 → 02 → … → 27 顺序走。适合考试或想彻底搞清楚的人。

🔨 想动手写代码

这个板块有个别的板块给不了的优势:几乎所有算法都能用几十行纯 Python 写出来 —— 不需要 GPU、不需要数据集、不需要装任何库,而且书上有标准答案可以对账

👉 27 · 实战与挑战项目(投票规则对比器 / 纳什均衡求解器 / 稳定匹配 / 公平分配实验室 / Shapley 计算器 / Braess 悖论复现)

📖 做题或考试时

👉 附录A · 速查 —— ⭐⭐ 24 张手算套路卡(矩阵法找纯 NE、 2×2 混合的无差异法、IESDS、逆向归纳、SPDA、TTC、Round-Robin、嫉妒图、Core 验证、 Shapley 六排列、IRV、Copeland…),外加约 80 条一行定义和 30 条常见陷阱。 它是「做题时翻的那一页」,不是重讲一遍。


🧩 五、每章长什么样

元素 它的作用 怎么用
时间徽章 告诉你现在要不要开始 只有 15 分钟就别开 40 分钟的章
🎯 一句话 全章压成一句 只看这一句就走,是被允许的
🔨 手算例子 ⭐⭐ 这套教程的核心 一定要拿纸跟着算一遍,光看会以为自己懂了
检查点 折叠答案,考你正文讲过的东西 答不上来就回去翻,不要跳过
🛑 可以停在这里 明确的退出点 停在这里不算失败,是设计好的
走神救援 ⭐ 全章要点压成一段,带具体数字 隔几天回来只读这一段就能接上,不用重读整章

⚠️ 和 💀 的区别:⚠️ 是坑(容易搞错的地方),💀 是真出过事的例子。


📐 六、关于数学

这套里有公式,但每个公式都是先给直觉、再给形式化


🔗 七、它和站里其他几套的关系

那一套 管什么 和这里的分界
强化学习基础 一个 agent 在环境里序贯决策 ⭐ 那边环境有随机性但不会针对你,所以能算出唯一最优策略。这套里对面会
智能体工程教程 多个 LLM agent 的工程协作 ⭐ 那边多 agent 目标一致,难点是工程;这套里 agent 目标冲突,难点是理论
推荐算法 15b · 广告 GSP / VCG 拍卖 ⭐⭐ 本套机制设计最赚钱的工业落点
模型上线之后 10 · SHAP 模型解释 ⭐ 那一章用的 Shapley 值,理论出处是第 23 章
机器学习的数学原理 11 · 没有免费的午餐 不存在普适最优算法 ⭐ 和第 26 章的 Arrow 定理是同一类结果

✅ 检查点

  1. 这套教程和站里其他几套最根本的区别是什么?一句话。
  2. 哪几章可以整段跳过?跳过之后从哪一章开始,会不会缺前置?
  3. 什么情况下反而应该读那几章?
  4. 你只有 2.5 小时、只想被"震一下",该走哪条路线?
  5. ⏱ 时间徽章是怎么算出来的?为什么说标少了比不标更糟?
  6. 「走神救援」该怎么用?
  7. 这套教程对「证明」的取舍原则是什么?举一个给证明和一个不给证明的例子。
  8. 强化学习那一套和这一套的分界在哪?
👀 答案
  1. 别的教程默认「对面不会算计你」,这一套讲那个假设不成立时的世界 —— 多个有自己利益的人凑在一起会发生什么,以及规则该怎么设计。
  2. 02–06 章(逻辑地基),2.6 小时。跳过后直接从第 7 章开始,不会缺任何前置。⭐ 之所以放在前面又允许跳过,是因为源课程(UNSW COMP4418)叫「知识表示与推理」,逻辑是它的另外半门课 —— 内容值得保留,但不该挡住想学博弈论的人。
  3. 想搞懂 SAT 求解器 / 形式化验证 / 定理证明(第 5 章分辨率是正主)、想知道知识图谱推理底下是什么(第 6 章一阶逻辑)、或者课程考试要考。
  4. 路线 C:07 → 24 投票规则 → 25 Condorcet 与锦标赛解 → 26 不可能定理。约 2.5 小时,最短且思想冲击最大。
  5. 170 字/分钟量出来的,不是拍脑袋写的。⭐ 标少了你会中途弃坑,而且从此不信这个数 —— 时间徽章的作用是让你决定「现在要不要开始」,不准就等于没有。
  6. ⭐ 它是全章要点压成一段、带具体数字的重述。隔几天回来只读这一段就能接上,不用重读整章 —— 这是为「读到一半走神/搁置」这个真实场景设计的。
  7. 只在「看懂了会改变理解」时才给证明第 15 章的势函数论证(很短很漂亮,而且解释了「为什么有些博弈保证有纯策略均衡」)。不给:Nash 存在性定理(要用不动点定理,给了也帮不上忙),只给结论和它意味着什么。
  8. 强化学习一个 agent 在环境里序贯决策,环境有随机性但不会针对你,所以能算出唯一最优策略;这一套里对面也在最大化,你的最优一旦被看穿就不再最优。(另外智能体工程教程的多 agent 目标一致、难点是工程;这里 agent 目标冲突、难点是理论。)

🚦 现在就开始

建议:先花 28 分钟读第 1 章的三个游戏。 它一个公式都不推,只让你亲手撞上这门学问的三堵墙 —— 撞完你就知道自己要不要继续了。

下一节 👉 01-第一天-三个游戏.md

🧭 已经知道自己要什么? 直接跳: 博弈论 → 07-偏好与效用.md | 机制设计 → 16-机制设计在解什么.md | 投票 → 24-投票规则.md


🛑 可以停在这里

走神救援

这一套和站里另外两个「决策」板块的分界,是理解它的第一把钥匙强化学习一个 agent 序贯决策,环境有随机性但不会针对你,所以能算出唯一最优策略;智能体工程是多个 LLM agent,目标一致、难点是工程;⭐⭐ 这一套是多个各有各利益的 agent,目标冲突、难点是理论 —— 你的最优策略一旦被看穿就不再最优。全部正文约 16.4 小时,分七段:逻辑地基(02–06,2.6 小时)、一个人怎么算理性(07–08,1.3h)、⭐⭐非合作博弈(09–15,4.5h,核心中的核心)、机制设计与匹配(16–18,1.8h)、公平分配(19–21,2.3h)、合作博弈(22–23,1.3h)、社会选择(24–26,2.1h)。数字按 170 字/分钟量出来,标少了比不标更糟,读得比这慢是正常的。⭐⭐ 全章最重要的一条:逻辑那五章(02–06)可以整段跳过。第 7 章直接开始不会缺任何前置知识 —— 之所以还放在前面,是因为源课程(UNSW COMP4418)叫「知识表示与推理」,逻辑是它的另外半门课,内容值得保留,但它不该挡住想学博弈论的人。什么时候该读它:想搞懂 SAT 求解器 / 形式化验证 / 定理证明,想知道知识图谱推理底下是什么(尤其第 6 章一阶逻辑),或者课程考试要考。四条读法:⭐ 路线 A(推荐) 只想懂博弈论,约 6 小时:07→08→09→10→11 纳什均衡 ⭐⭐→12→13,第 11 章是整套的枢纽,读到那里就算入门,14–15 之后再补;路线 B 做平台/广告/撮合,约 5 小时:07→09→11→16 机制设计 ⭐⭐→17→18,⭐ 第 16 章是转折点 —— 从「预测会发生什么」翻转成「设计让什么发生」,工业落点就在《推荐算法》15b路线 C 只关心投票,约 2.5 小时:07→24→25→26 不可能定理 ⭐⭐,⭐ 这条线最短、思想冲击最大路线 D 完整 16 小时。🔨 想动手:⭐ 这个板块有个别处给不了的优势 —— 几乎所有算法都能用几十行纯 Python 写出来,不要 GPU、不要数据集、不用装库,而且书上有标准答案可以对账27 章六个项目)。📖 做题或考试附录A24 张手算套路卡 + 约 80 条一行定义 + 30 条常见陷阱,是「做题时翻的那一页」,不是重讲一遍关于数学:⭐ 证明只在「看懂了会改变理解」时才给 —— 第 15 章的势函数论证(很短很漂亮,而且解释了为什么有些博弈保证有纯策略均衡),Nash 存在性定理不给(要用不动点定理,给了也帮不上忙),只给结论和它意味着什么。⚠️ 看不懂公式时先跳过去看它下面的手算例子,这套里的公式基本都能靠例子倒推回来。另外两条跨板块的线第 23 章 Shapley 值《模型上线之后》SHAP的理论出处;第 26 章的 Arrow 定理和《数学原理》没有免费的午餐同一类结果建议先花 28 分钟读第 1 章的三个游戏 —— 它一个公式都不推,只让你亲手撞上这门学问的三堵墙,撞完你就知道自己要不要继续。

打卡记录保存在你的浏览器里,首页能看到总进度