输入没有闭合
你不知道自己漏了什么。
Learn / AI 编程工作流
Where it breaks / 断在哪
「想法 → 交付」之间那条链每次都在同样的地方断开。断点有三个,没有一个是「提示词写得好不好」。
你不知道自己漏了什么。
AI 遇到不确定就自己猜。
「做完了」由 AI 自己判断。
第二个问题比第一个更致命:怕流程太重,所以流程永远建不起来。下面三条是对这件事的直接回应。
默认档位是快车道:五步、约 10 分钟、不产生任何流程文件。
一个每次都要写任务单、写计划、来回批注的流程,跑三次就会放弃,然后退回「一句话丢给 AI」。
重的部分不是「应该做但嫌麻烦」,而是「默认不做,被明确信号触发才做」。
「重要的任务要认真做」没用,因为「重要」无法当场判定。
触发器必须是看一眼就能回答的问题:要动几个文件、做偏了几次、一个会话做不做得完。
可判定的信号取代意志力,命中任意一条就升级。
流程开销不得超过任务本身预计时间的 20%,超了就降档。
这条规则把「要不要走流程」从一次意志力较量变成一次算术。
30 分钟的任务,流程上限 6 分钟。
Three paths / 三条阅读路径
教材按三条路径组织,每章开头都写明「什么信号出现时你需要这一章」。第 3–5 层是查阅型内容,不是一口气读完的内容。
Start / 上手
当天就用上快车道,解决现有问题里的大部分。
读完这 8 章就停下来去用。第 3–5 层是查阅型内容,不要一口气读完。
Main / 主干
稳定的日常流程,含标准道与已有项目维护。
每章开头都写明「什么信号出现时你需要这一章」。
Deep / 深入
机制层、规模化、多代理、度量。
不是读完的内容,是需要时查的内容。
Default gear / 默认档位
这是整套教材的默认档位,也是判断这份设计对不对的地方 —— 你得先看到它有多轻。第一次约 10 分钟,熟练后 3 分钟。
一句话说要什么,再补三件事:不要做什么 / 怎么算完成 / 不许碰哪里。末尾加一句自主权边界。
2 分钟
一条指令:先调查再给方案,明确禁止写代码。两个工具的做法不同,见对照表 D1。
10 秒
回一个「行」,或者改一句话。
2 分钟
要求它跑一个检查,并把输出贴出来。
等
看 diff + 看检查结果 + 决定。
3 分钟
这一档不用
命中任意一条就升到标准道。每一条都是看一眼就能回答的问题。
再往上 · 高风险道涉及钱、权限、隐私数据、数据迁移,或者改错了要花超过半天恢复。
流程开销不得超过任务本身预计时间的 20%。超了就降档。
| 任务预计 | 流程上限 | 只能走 |
|---|---|---|
| 30 分钟 | 6 分钟 | 快车道 |
| 半天 | 40 分钟 | 标准道 |
| 一天以上 | 1.5 小时起 | 标准道或高风险道 |
| 对照项 | 快车道 | 标准道 | 高风险道 |
|---|---|---|---|
| 产出文件 | 0 个 | 2 个:任务单、计划 | 4 个:另加审查记录、回滚方案 |
| 计划批注循环 | 无 | 1–2 轮 | 按需 |
| 验证 | 1 条检查命令 | 自动检查 + 人工验收清单 | 另加对抗式审查与回滚演练 |
| 权限档位 | 常规 | 常规 | 只读起步 + 硬拦截 |
Six levels / 能力地图
不用「理解了」「熟悉了」这类无法判定的词。六级阶梯,每一级配一条做得到才算过的结业检验。
知道 AI 会怎么失败,知道人要保留什么判断。
结业检验看一段 AI 的完成汇报,指出其中未被证据支持的断言至少 2 处。
用 5 步、0 个文件,跑通一次「想法 → 交付」。
结业检验用快车道连续完成 3 个任务,全程 0 个流程文件,且没有一次返工超过一轮。
能识别升级触发器,并在触发时补上任务单、计划、审查。
结业检验遇到升级触发器时正确升级;完成案例 A,含任务单、计划与验证证据。
按信号引入规则文件、Skills、Hooks、MCP、子代理,并能验证它生效。
结业检验项目里有一份被两个工具都正确读取的规则文件,且你有「我如何确认它生效」的记录。
长任务、上下文管理、权限与成本、多代理、流程度量。
结业检验完成案例 C:有范围控制、失败处理、回滚方案,事后能给出返工率与审查耗时的粗略数字。
形成自己的默认流程与排障树,并能砍掉不适合自己的部分。
结业检验产出自己的一页纸流程 + 排障树,且砍掉本教材推荐里至少一项,并说明理由。
给 10 个任务描述,10 分钟内分入「快车道 / 标准道 / 高风险道 / 不交给 AI」四档,每档说出至少一条判定依据;与参考答案分歧不超过 2 项。
快车道级:3 分钟内写出「要什么 + 三件事 + 自主权边界」四行。标准道级:20 分钟内产出任务单,非目标至少 2 条,验收标准中至少 3 条是可执行命令或可观察的页面行为。
调查回复里事实项带文件路径与行号、假设项带改动成本、问题不超过 5 个且按影响排序;你能指出其中至少一个被错分类的项。
两份启动清单各执行一次;已有项目那份必须含「先建立可运行基线与最小回归网」,并能说明新项目为何不需要。
完成一次跨两个会话的任务,第二个会话不重述背景即可继续;并能指出这次哪一步该切分而没切。
交付时拿出四类证据中至少三类;并能指出 AI 声称完成但证据缺失的地方。
对每种机制能回答同一组五问;实际验证过至少三种机制确实生效,并留有记录。
8 个故障场景能在排障树上定位并给出下一步;「AI 改测试迁就代码」和「上下文丢失后自信执行」两个必须答对。
写出你的三层权限基线,并在两个工具里都实际配置生效;能对一次任务给出停止条件。
对每个收录案例,说出它成立的前提中你不具备的那一条,以及你要借鉴的部分改编成什么样。
Full outline / 完整目录
导读加六层,一共 7 个部分。层级标记回答「必不必学」,路径标记回答「什么时候读」。标了进阶或暂缓的章节都附一条触发信号 —— 信号没出现就不必看。
基础必学进入下一层前要读完
进阶选学触发信号出现时再读
暂可跳过条件变了再回来
How to read
3 章
0.1重点展开
知道自己现在该读哪 8 章;记住默认走轻的、升级靠触发器、流程预算 20% 三条原则。
0.2
用一段白话说清模型、会话、编程代理、工具、工作区、上下文、权限这七个词的关系。
0.3
读到任何结论都知道它的证据强度:官方文档、团队自述、作者经验、受控研究、我的建议。
Calibration
6 章
1.1
画出「提示 → 模型 → 工具调用 → 结果回灌 → 停止判断」,并指出每一步人能在哪里介入。
1.2
说出按下第一个回车前上下文里已经有什么;解释长会话为何质量下降;压缩后什么会丢。
1.3重点展开
需求完整性、可验证性、范围控制、边界情况、工程质量、可回退性,每样给出补齐手段。
1.4重点展开
乐观完成、需求自动补空、改测试迁就代码、范围蔓延、幻觉 API、沉默降级、上下文丢失后自信执行、过度工程、错误方向坚持,每种带一句话识别信号。
1.5重点展开
掌握 9 个维度的差异,重点是 4 处会真正影响操作的差异;其中计划模式的差异直接关系到快车道第 2 步的安全性。
1.6
对一个具体任务列出这三类里哪几个点必须你定。
First run
4 章
2.1重点展开
分支、基线、可运行、一条检查命令、三层权限基线,两个工具各给一份配置。
2.2重点展开
本教材的主干章。用最小工具集走完想法 → 方案 → 确认 → 实现 → 验收,全程 0 个流程文件。
2.3重点展开
记住 4 条升级触发器和流程预算 20% 规则,能对一个具体任务算出该走哪档。
2.4
改了不该改的文件、测试是假的、范围偷偷变大、提交信息掩盖真实改动、无法回滚。
Daily loop
15 章
每章分快车道版与标准道版,并写明什么信号出现时才需要标准道版;每章明确谁负责、输入、产出物、进入下一步的门槛。
3.1重点展开
快车道版是三句话补全法,2 分钟学会;标准道版是五个缺口 + 三分法 + 问题预算 + 任务单。含「我也没想清楚」和「AI 做错方向」两种局面的话术。
3.2
写出调查指令;审查调查报告并指出错误分类。
3.3重点展开
判断何时口头够用、何时必须落成文件;给出任务单模板。
3.4重点展开
「生成计划 → 本地批注 → 回灌 → 显式禁止实现」的循环;两个工具的计划模式差异;什么时候跳过计划。
3.5
把计划切成可独立验证、可独立回滚的片;识别切片过大的三个信号。
3.6重点展开
为一次改动设计「AI 自己能跑的检查」;区分「跑过了」和「证明了」;四类证据。
3.7重点展开
先复现、再定位、后修复;识别并阻止 AI 吞错误、放宽断言、跳过测试。
3.8重点展开
人必审清单;用独立会话做对抗审查,并处理「审查者硬找问题导致过度工程」的副作用。
3.9
写出回滚方案并演练一次。
3.10
截图、浏览器检查、设计对照。
触发信号你开始靠肉眼反复看页面判断对错。
3.11
把契约写在前面,让迁移可回滚。
触发信号任务涉及对外接口或数据库迁移。
3.12重点展开
对没有测试的旧模块,动手前建立最小回归保护。
3.13
把新的约束写回规格,而不是靠对话记忆续接。
触发信号做到一半你改主意了。
3.14
让下一个会话不重述背景就能接着做。
触发信号一个任务一个会话做不完。
3.15
每一步的输入、产出物、进入下一步的门槛。
Mechanisms
12 章
本层的核心结论先说:头两周你只需要三样东西 —— 一个规则文件、一个验收习惯、一条能跑的检查命令。其余机制全部附「什么信号出现时才装」,并统一回答同一组五问。
4.1重点展开
面对一个诉求,30 秒选出该用哪种机制,并说出为什么不用另外两种;以及为什么现在多数机制你都不该装。
4.2重点展开
本层最重要的一章。两边都用就必须处理规则文件读取范围的差异,给出具体做法与验证方法,附 Cursor / Copilot 对照。
4.3
五种文档各自的读者、寿命、存放位置,以及与规则文件的分工。
4.4重点展开
一份可直接复制的目录结构 + 每个文件的真实内容,同时被两个工具正确读取。
4.5重点展开
每种机制至少一种验证手段;诊断「我写了规则但 AI 不遵守」的三种原因。
4.6
把重复贴进对话的流程固化下来。
触发信号同一段流程你贴进对话第三遍了。
4.7
用确定性机制替代反复叮嘱。
触发信号你反复叮嘱同一件事而它反复漏做。
4.8
判断一个外部数据源值不值得接进来。
触发信号你在反复从某个浏览器标签页往对话里复制数据。
4.9
把大调研挪出主会话。
触发信号一次调研把你的会话冲垮了。
4.10
让规则按目录生效,而不是堆在一个文件里。
触发信号规则文件超过 200 行。
4.11
让两件事同时推进而不互相踩脚。
触发信号你想同时推进两件事而它们互相踩脚。
4.12
把手动检查搬到流水线上。
触发信号你开始忘记手动跑检查。
At scale
11 章
5.1重点展开
让跨越多次压缩的任务不丢关键信息;说出压缩后什么会自动回来、什么不会。
5.2重点展开
为每类任务预设停止条件(轮次、时间、花费、连续失败次数);识别「它已经在原地打转」。
5.3重点展开
配一套「跑得开但跑不出去」的环境;知道哪些操作任何模式都不该自动放行。
5.4
让工具失败变成可见的停止,而不是编造。
触发信号MCP 断连或命令超时后它开始编造。
5.5
判断第二个会话值不值得开。
触发信号你在考虑开第二个会话。
5.6
让并行的会话不互相覆盖。
触发信号你已经在跑两个以上会话。
5.7重点展开
面对「效果不好」,能定位是三者中哪一个的问题,而不是直接换模型。
5.8重点展开
建立四个可记录指标:一次通过率、返工轮次、漏出缺陷、人工审查耗时;说明「生成了多少代码」为何是坏指标。
5.9
让花费可预期。
触发信号你开始在意账单。
5.10重点展开
对每个收录案例,指出它成立的前提、你缺哪一条、可借鉴的是哪部分。
5.11
了解个人流程之上的一层。
触发信号你开始带团队,或需要跨仓库批量改造。
Your own loop
6 章
6.1重点展开
可贴在显示器旁的流程卡,含三档路径。
6.2重点展开
只给 6 个模板:三句话补全、调查指令、任务单、计划批注、审查提示、交接记录。不给大而全的提示词合集。
6.3重点展开
从症状出发三步定位到动作。
6.4重点展开
每阶段有明确练习、验收标准与参考解答;第 1 天的练习必须当天能做完。
6.5
一张分类表,避免你现在就去堆工具。
6.6重点展开
三个可判定信号:任务单比代码长、连续 3 次在同一步走过场、为走流程而推迟开始。附「砍流程」的操作步骤。
案例 A 知识库加搜索(从模糊想法开始)、案例 B 已有项目定位 Bug 到回归测试、案例 C 跨文件重构与批量迁移。每个都展示原始需求 → 遗漏分析 → 关键澄清对话 → 任务单 → 计划及批注 → 实施切片 → 验证 → 审查 → 交付 → 复盘,并附「换成你自己的项目怎么做」。
三个案例是教学设计案例,不是真实交付记录,正文开头显著标注。
6 个核心模板,中英对照,刻意做小。
每条含标题、作者或机构、发布时间、访问日期、链接与证据类型。
其中 11 个证据缺口保持列出而不填平:用搜索摘要补细节会违反本书的证据规则。
Codex 与 Claude Code 在 9 个维度的对照,附 Cursor / Copilot 参考列,以及「以官方文档为准」的复核入口。
Evidence / 方法与证据
多数教程给你一套完整流程然后说「按需简化」,但没人会简化。这里反过来:默认最轻,重的部分靠可判定的触发器启动。
你配了规则文件但 AI 不遵守,多数教程不告诉你怎么诊断。这里每种机制都必须给出验证手段。
有受控研究显示 AI 工具在特定条件下让资深开发者变慢,也有大样本调研显示 AI 会放大组织既有的强项和缺陷。用来校准期待和度量方式,不是唱反调。
所有把企业做法改编成个人做法的地方都分开写,不混在一起。
| 标记 | 含义 | 该怎么对待 |
|---|---|---|
| 官方文档 | 产品方发布的当前文档 | 可以照做,但注意核对日期,这类内容变化最快。 |
| 团队自述 | 企业工程博客的自我描述 | 说明「他们怎么做」,不能当作「这么做有效」的独立证明。 |
| 受控研究 | 随机对照实验、大样本调研 | 用于校准期待,必须看清适用范围和测量口径。 |
| 作者经验 | 个人开发者的公开文章 | 一种可行做法,样本为一,别当普适规律。 |
| 我的建议 | 教材作者的综合判断与改编 | 会尽量说明理由,但可能错,你自己判断。 |
mynotes一个 Markdown 个人知识库站点,第 2.1 章给出从零搭建步骤,约 15 分钟。三个案例都在它上面做。
方法不绑定这套技术栈。出现具体框架只是为了让命令能真的跑起来;换成别的服务端框架,流程一模一样。
所有涉及产品当前实现的描述都注明核对日期 2026-09-08 与官方文档链接;实现会变,以你阅读时的官方文档为准。
所有教学对话、命令输出与测试结果均为设计的示例并标注为模拟,不把未执行的内容写成执行记录。