Learn / AI 编程工作流

KEEP THE
PROCESS
LIGHT.

一套 AI 编程工作流的课程设计:默认档位刻意做轻,重的部分只在可判定的信号出现时才启动。 导读加六层,共 57 章,其中 29 章重点展开。

Where it breaks / 断在哪

问题不在提示词,
在输入、责任和完成的定义。

「想法 → 交付」之间那条链每次都在同样的地方断开。断点有三个,没有一个是「提示词写得好不好」。

  1. 想法不完整
  2. AI 不追问
  3. AI 用自己的默认值补空
  4. 代码写完了
  5. 看起来做完了
  6. 范围、体验、边界与工程质量不到位
  7. 你不断补指令、返工

输入没有闭合

你不知道自己漏了什么。

需要的机制
一份缺口清单,让「漏了什么」可以逐条检查。
落在快车道哪一步
第 1 步的「补三件事」

责任没有划分

AI 遇到不确定就自己猜。

需要的机制
三分法:可查证的自己查、可逆假设自己定但要声明、不可逆决策必须问。
落在快车道哪一步
第 1 步末尾那一句自主权边界

完成没有定义

「做完了」由 AI 自己判断。

需要的机制
一个 AI 自己能跑的检查。
落在快车道哪一步
第 1 步的「怎么算完成」+ 第 4 步

贯穿全书的三原则

第二个问题比第一个更致命:怕流程太重,所以流程永远建不起来。下面三条是对这件事的直接回应。

  1. 默认走轻的

    默认档位是快车道:五步、约 10 分钟、不产生任何流程文件。

    一个每次都要写任务单、写计划、来回批注的流程,跑三次就会放弃,然后退回「一句话丢给 AI」。

    重的部分不是「应该做但嫌麻烦」,而是「默认不做,被明确信号触发才做」。

  2. 升级靠触发器,不靠自觉

    「重要的任务要认真做」没用,因为「重要」无法当场判定。

    触发器必须是看一眼就能回答的问题:要动几个文件、做偏了几次、一个会话做不做得完。

    可判定的信号取代意志力,命中任意一条就升级。

  3. 流程预算 20%

    流程开销不得超过任务本身预计时间的 20%,超了就降档。

    这条规则把「要不要走流程」从一次意志力较量变成一次算术。

    30 分钟的任务,流程上限 6 分钟。

Three paths / 三条阅读路径

不要从头读到尾,
先读能当天用上的那 8 章。

教材按三条路径组织,每章开头都写明「什么信号出现时你需要这一章」。第 3–5 层是查阅型内容,不是一口气读完的内容。

Start / 上手

规模
8 章
投入
约 2 小时

当天就用上快车道,解决现有问题里的大部分。

  • 0.1
  • 1.3
  • 1.4
  • 2.1
  • 2.2
  • 2.3
  • 3.1
  • 3.6

读完这 8 章就停下来去用。第 3–5 层是查阅型内容,不要一口气读完。

Main / 主干

规模
再加 14 章
投入
约 1 周,边做边读

稳定的日常流程,含标准道与已有项目维护。

  • 0.2
  • 0.3
  • 1.1
  • 1.2
  • 1.5
  • 1.6
  • 2.4
  • 3.2–3.5
  • 3.7–3.9
  • 3.12
  • 3.15
  • 4.1–4.5
  • 6.1–6.6

每章开头都写明「什么信号出现时你需要这一章」。

Deep / 深入

规模
其余章节
投入
按触发条件回来查

机制层、规模化、多代理、度量。

  • 3.10–3.14
  • 4.6–4.12
  • 5.1–5.11

不是读完的内容,是需要时查的内容。

Default gear / 默认档位

五步、约十分钟,
全程不产生任何文件。

这是整套教材的默认档位,也是判断这份设计对不对的地方 —— 你得先看到它有多轻。第一次约 10 分钟,熟练后 3 分钟。

  1. 说清楚

    一句话说要什么,再补三件事:不要做什么 / 怎么算完成 / 不许碰哪里。末尾加一句自主权边界。

    2 分钟

  2. 先要方案

    一条指令:先调查再给方案,明确禁止写代码。两个工具的做法不同,见对照表 D1。

    10 秒

  3. 看方案

    回一个「行」,或者改一句话。

    2 分钟

  4. 让它做

    要求它跑一个检查,并把输出贴出来。

  5. 收不收

    看 diff + 看检查结果 + 决定。

    3 分钟

这一档不用

  • 任务单
  • plan.md
  • 批注循环
  • Skills
  • Hooks
  • MCP
  • 子代理
  • worktree
  • CI

升级触发器

命中任意一条就升到标准道。每一条都是看一眼就能回答的问题。

  • 同一个问题它做偏了两次
  • 要动 3 个以上文件,或你不知道该动哪里
  • 涉及数据结构、对外接口、或用户能看见的行为
  • 一个会话做不完

再往上 · 高风险道涉及钱、权限、隐私数据、数据迁移,或者改错了要花超过半天恢复。

流程预算 20%

流程开销不得超过任务本身预计时间的 20%。超了就降档。

任务预计流程上限只能走
30 分钟6 分钟快车道
半天40 分钟标准道
一天以上1.5 小时起标准道或高风险道

三档产出物对照

对照项快车道标准道高风险道
产出文件0 个2 个:任务单、计划4 个:另加审查记录、回滚方案
计划批注循环1–2 轮按需
验证1 条检查命令自动检查 + 人工验收清单另加对抗式审查与回滚演练
权限档位常规常规只读起步 + 硬拦截

Six levels / 能力地图

每一级的成果
都必须可以检查。

不用「理解了」「熟悉了」这类无法判定的词。六级阶梯,每一级配一条做得到才算过的结业检验。

  1. L0

    认识层

    知道 AI 会怎么失败,知道人要保留什么判断。

    结业检验看一段 AI 的完成汇报,指出其中未被证据支持的断言至少 2 处。

  2. L1

    快车道

    用 5 步、0 个文件,跑通一次「想法 → 交付」。

    结业检验用快车道连续完成 3 个任务,全程 0 个流程文件,且没有一次返工超过一轮。

  3. L2

    标准道

    能识别升级触发器,并在触发时补上任务单、计划、审查。

    结业检验遇到升级触发器时正确升级;完成案例 A,含任务单、计划与验证证据。

  4. L3

    机制层

    按信号引入规则文件、Skills、Hooks、MCP、子代理,并能验证它生效。

    结业检验项目里有一份被两个工具都正确读取的规则文件,且你有「我如何确认它生效」的记录。

  5. L4

    规模化

    长任务、上下文管理、权限与成本、多代理、流程度量。

    结业检验完成案例 C:有范围控制、失败处理、回滚方案,事后能给出返工率与审查耗时的粗略数字。

  6. L5

    个人方法

    形成自己的默认流程与排障树,并能砍掉不适合自己的部分。

    结业检验产出自己的一页纸流程 + 排障树,且砍掉本教材推荐里至少一项,并说明理由。

十项能力的落点与检查标准

  • 判断任务适不适合交给 AI、交到什么程度

    L0 → L11.3、1.6、2.3

    给 10 个任务描述,10 分钟内分入「快车道 / 标准道 / 高风险道 / 不交给 AI」四档,每档说出至少一条判定依据;与参考答案分歧不超过 2 项。

  • 把不完整的想法变成目标、范围、约束、验收与计划

    L1 → L23.1、3.3、3.4

    快车道级:3 分钟内写出「要什么 + 三件事 + 自主权边界」四行。标准道级:20 分钟内产出任务单,非目标至少 2 条,验收标准中至少 3 条是可执行命令或可观察的页面行为。

  • 让 AI 先调查,并区分事实、可逆假设与人决定

    L23.2

    调查回复里事实项带文件路径与行号、假设项带改动成本、问题不超过 5 个且按影响排序;你能指出其中至少一个被错分类的项。

  • 新项目与已有项目的不同启动方式

    L1 → L22.1、3.12、4.4

    两份启动清单各执行一次;已有项目那份必须含「先建立可运行基线与最小回归网」,并能说明新项目为何不需要。

  • 控制上下文、任务规模、修改范围与会话交接

    L2 → L41.2、3.5、3.14、5.1

    完成一次跨两个会话的任务,第二个会话不重述背景即可继续;并能指出这次哪一步该切分而没切。

  • 用测试、运行、页面检查与审查判断真的完成

    L1 → L23.6、3.7、3.8

    交付时拿出四类证据中至少三类;并能指出 AI 声称完成但证据缺失的地方。

  • 按需引入规则文件、Skills、Hooks、MCP、子代理与 CI

    L34.1–4.12

    对每种机制能回答同一组五问;实际验证过至少三种机制确实生效,并留有记录。

  • 处理返工、卡住、错误实现、错误测试、上下文丢失与多代理冲突

    L2 → L43.7、5.4、5.6、6.3

    8 个故障场景能在排障树上定位并给出下一步;「AI 改测试迁就代码」和「上下文丢失后自信执行」两个必须答对。

  • 管理权限、敏感信息、发布、回滚与成本

    L1 → L42.1、5.2、5.3、5.9

    写出你的三层权限基线,并在两个工具里都实际配置生效;能对一次任务给出停止条件。

  • 借鉴企业与开发者实践,并判断适用性

    L4 → L55.10、附录 A

    对每个收录案例,说出它成立的前提中你不具备的那一条,以及你要借鉴的部分改编成什么样。

Full outline / 完整目录

57 章,
每章都标好该不该现在读。

导读加六层,一共 7 个部分。层级标记回答「必不必学」,路径标记回答「什么时候读」。标了进阶或暂缓的章节都附一条触发信号 —— 信号没出现就不必看。

基础必学进入下一层前要读完

进阶选学触发信号出现时再读

暂可跳过条件变了再回来

怎么用这套教材

How to read

3

  • 0.1重点展开

    三条阅读路径与快车道三原则

    知道自己现在该读哪 8 章;记住默认走轻的、升级靠触发器、流程预算 20% 三条原则。

    基础必学Start / 上手

  • 0.2

    术语最小集

    用一段白话说清模型、会话、编程代理、工具、工作区、上下文、权限这七个词的关系。

    基础必学Main / 主干

  • 0.3

    证据标注约定

    读到任何结论都知道它的证据强度:官方文档、团队自述、作者经验、受控研究、我的建议。

    基础必学Main / 主干

建立正确认识

Calibration

6

  • 1.1

    一次代理循环里发生了什么

    画出「提示 → 模型 → 工具调用 → 结果回灌 → 停止判断」,并指出每一步人能在哪里介入。

    基础必学Main / 主干

  • 1.2

    上下文窗口是第一约束

    说出按下第一个回车前上下文里已经有什么;解释长会话为何质量下降;压缩后什么会丢。

    基础必学Main / 主干

  • 1.3重点展开

    「能写代码」和「能可靠交付」差的六样东西

    需求完整性、可验证性、范围控制、边界情况、工程质量、可回退性,每样给出补齐手段。

    基础必学Start / 上手

  • 1.4重点展开

    AI 的 9 种失败模式

    乐观完成、需求自动补空、改测试迁就代码、范围蔓延、幻觉 API、沉默降级、上下文丢失后自信执行、过度工程、错误方向坚持,每种带一句话识别信号。

    基础必学Start / 上手

  • 1.5重点展开

    Codex 与 Claude Code 的形态对照

    掌握 9 个维度的差异,重点是 4 处会真正影响操作的差异;其中计划模式的差异直接关系到快车道第 2 步的安全性。

    基础必学Main / 主干

  • 1.6

    人必须保留的三类判断:产品、架构、风险

    对一个具体任务列出这三类里哪几个点必须你定。

    基础必学Main / 主干

第一次跑通

First run

4

  • 2.1重点展开

    十分钟把工作区变安全

    分支、基线、可运行、一条检查命令、三层权限基线,两个工具各给一份配置。

    基础必学Start / 上手

  • 2.2重点展开

    快车道:五步跑通第一个任务

    本教材的主干章。用最小工具集走完想法 → 方案 → 确认 → 实现 → 验收,全程 0 个流程文件。

    基础必学Start / 上手

  • 2.3重点展开

    什么时候必须升级流程

    记住 4 条升级触发器和流程预算 20% 规则,能对一个具体任务算出该走哪档。

    基础必学Start / 上手

  • 2.4

    第一次常见的五种翻车与现场纠正

    改了不该改的文件、测试是假的、范围偷偷变大、提交信息掩盖真实改动、无法回滚。

    基础必学Main / 主干

日常工作流

Daily loop

15

每章分快车道版与标准道版,并写明什么信号出现时才需要标准道版;每章明确谁负责、输入、产出物、进入下一步的门槛。

  • 3.1重点展开

    需求不完整时怎样与 AI 协作补齐

    快车道版是三句话补全法,2 分钟学会;标准道版是五个缺口 + 三分法 + 问题预算 + 任务单。含「我也没想清楚」和「AI 做错方向」两种局面的话术。

    基础必学Start / 上手Main / 主干

  • 3.2

    让 AI 先调查:事实 / 可逆假设 / 人决定

    写出调查指令;审查调查报告并指出错误分类。

    基础必学Main / 主干

  • 3.3重点展开

    从三句话到任务单:什么时候才需要文件

    判断何时口头够用、何时必须落成文件;给出任务单模板。

    基础必学Main / 主干

  • 3.4重点展开

    计划与批注

    「生成计划 → 本地批注 → 回灌 → 显式禁止实现」的循环;两个工具的计划模式差异;什么时候跳过计划。

    基础必学Main / 主干

  • 3.5

    小步实现与切片

    把计划切成可独立验证、可独立回滚的片;识别切片过大的三个信号。

    基础必学Main / 主干

  • 3.6重点展开

    验证与证据

    为一次改动设计「AI 自己能跑的检查」;区分「跑过了」和「证明了」;四类证据。

    基础必学Start / 上手

  • 3.7重点展开

    调试:从症状到根因,禁止绕过错误

    先复现、再定位、后修复;识别并阻止 AI 吞错误、放宽断言、跳过测试。

    基础必学Main / 主干

  • 3.8重点展开

    代码审查:人审什么、AI 审什么、对抗式审查

    人必审清单;用独立会话做对抗审查,并处理「审查者硬找问题导致过度工程」的副作用。

    基础必学Main / 主干

  • 3.9

    交付与回滚

    写出回滚方案并演练一次。

    基础必学Main / 主干

  • 3.10

    UI 迭代循环

    截图、浏览器检查、设计对照。

    触发信号你开始靠肉眼反复看页面判断对错。

    进阶选学Deep / 深入

  • 3.11

    接口与数据库:契约先行与迁移安全

    把契约写在前面,让迁移可回滚。

    触发信号任务涉及对外接口或数据库迁移。

    进阶选学Deep / 深入

  • 3.12重点展开

    已有项目维护:先建安全网再动手

    对没有测试的旧模块,动手前建立最小回归保护。

    基础必学Main / 主干

  • 3.13

    需求中途变化:改规格而不是改记忆

    把新的约束写回规格,而不是靠对话记忆续接。

    触发信号做到一半你改主意了。

    进阶选学Deep / 深入

  • 3.14

    会话交接与续命文档

    让下一个会话不重述背景就能接着做。

    触发信号一个任务一个会话做不完。

    进阶选学Deep / 深入

  • 3.15

    责任表(一页)

    每一步的输入、产出物、进入下一步的门槛。

    基础必学Main / 主干

上下文与工具机制

Mechanisms

12

本层的核心结论先说:头两周你只需要三样东西 —— 一个规则文件、一个验收习惯、一条能跑的检查命令。其余机制全部附「什么信号出现时才装」,并统一回答同一组五问。

  • 4.1重点展开

    机制决策树,以及「现在你只需要三样东西」

    面对一个诉求,30 秒选出该用哪种机制,并说出为什么不用另外两种;以及为什么现在多数机制你都不该装。

    基础必学Main / 主干

  • 4.2重点展开

    规则文件双工具配置:CLAUDE.md 与 AGENTS.md

    本层最重要的一章。两边都用就必须处理规则文件读取范围的差异,给出具体做法与验证方法,附 Cursor / Copilot 对照。

    基础必学Main / 主干

  • 4.3

    文档类产物:规格 / 任务单 / 计划 / 决策记录 / 交接记录

    五种文档各自的读者、寿命、存放位置,以及与规则文件的分工。

    基础必学Main / 主干

  • 4.4重点展开

    最小项目目录与关键文件全示例

    一份可直接复制的目录结构 + 每个文件的真实内容,同时被两个工具正确读取。

    基础必学Main / 主干

  • 4.5重点展开

    逐机制的「它真的生效了吗」验证清单

    每种机制至少一种验证手段;诊断「我写了规则但 AI 不遵守」的三种原因。

    基础必学Main / 主干

  • 4.6

    Skills:两套路径与预算差异

    把重复贴进对话的流程固化下来。

    触发信号同一段流程你贴进对话第三遍了。

    进阶选学Deep / 深入

  • 4.7

    Hooks:把「必须每次发生」变成确定性护栏

    用确定性机制替代反复叮嘱。

    触发信号你反复叮嘱同一件事而它反复漏做。

    进阶选学Deep / 深入

  • 4.8

    MCP:收益与代价

    判断一个外部数据源值不值得接进来。

    触发信号你在反复从某个浏览器标签页往对话里复制数据。

    进阶选学Deep / 深入

  • 4.9

    子代理与上下文隔离

    把大调研挪出主会话。

    触发信号一次调研把你的会话冲垮了。

    进阶选学Deep / 深入

  • 4.10

    路径作用域规则与大仓库

    让规则按目录生效,而不是堆在一个文件里。

    触发信号规则文件超过 200 行。

    进阶选学Deep / 深入

  • 4.11

    Git worktree 与并行会话

    让两件事同时推进而不互相踩脚。

    触发信号你想同时推进两件事而它们互相踩脚。

    进阶选学Deep / 深入

  • 4.12

    CI 与自动化验证

    把手动检查搬到流水线上。

    触发信号你开始忘记手动跑检查。

    进阶选学Deep / 深入

深入实践与规模化

At scale

11

  • 5.1重点展开

    长任务:上下文压缩、重启、持久化进度

    让跨越多次压缩的任务不丢关键信息;说出压缩后什么会自动回来、什么不会。

    基础必学Deep / 深入

  • 5.2重点展开

    停止条件与预算:什么时候必须叫停

    为每类任务预设停止条件(轮次、时间、花费、连续失败次数);识别「它已经在原地打转」。

    基础必学Deep / 深入

  • 5.3重点展开

    权限、密钥与沙箱

    配一套「跑得开但跑不出去」的环境;知道哪些操作任何模式都不该自动放行。

    基础必学Deep / 深入

  • 5.4

    工具失败与降级路径

    让工具失败变成可见的停止,而不是编造。

    触发信号MCP 断连或命令超时后它开始编造。

    进阶选学Deep / 深入

  • 5.5

    一个代理够不够:多代理的价值与代价

    判断第二个会话值不值得开。

    触发信号你在考虑开第二个会话。

    进阶选学Deep / 深入

  • 5.6

    多代理的任务归属、依赖、集成与冲突

    让并行的会话不互相覆盖。

    触发信号你已经在跑两个以上会话。

    进阶选学Deep / 深入

  • 5.7重点展开

    模型能力 vs 执行环境 vs 反馈机制

    面对「效果不好」,能定位是三者中哪一个的问题,而不是直接换模型。

    基础必学Deep / 深入

  • 5.8重点展开

    用什么指标评估你的流程

    建立四个可记录指标:一次通过率、返工轮次、漏出缺陷、人工审查耗时;说明「生成了多少代码」为何是坏指标。

    基础必学Deep / 深入

  • 5.9

    成本管理

    让花费可预期。

    触发信号你开始在意账单。

    进阶选学Deep / 深入

  • 5.10重点展开

    企业与开发者实践的适用条件分析

    对每个收录案例,指出它成立的前提、你缺哪一条、可借鉴的是哪部分。

    基础必学Deep / 深入

  • 5.11

    组织层做法:平台团队与批量改造机队

    了解个人流程之上的一层。

    触发信号你开始带团队,或需要跨仓库批量改造。

    暂可跳过Deep / 深入

形成自己的方法

Your own loop

6

  • 6.1重点展开

    一页纸默认流程

    可贴在显示器旁的流程卡,含三档路径。

    基础必学Main / 主干

  • 6.2重点展开

    模板库(刻意做小)

    只给 6 个模板:三句话补全、调查指令、任务单、计划批注、审查提示、交接记录。不给大而全的提示词合集。

    基础必学Main / 主干

  • 6.3重点展开

    排障决策树

    从症状出发三步定位到动作。

    基础必学Main / 主干

  • 6.4重点展开

    练习路径:第 1 天 / 第 1 周 / 第 1 个月

    每阶段有明确练习、验收标准与参考解答;第 1 天的练习必须当天能做完。

    基础必学Main / 主干

  • 6.5

    现在必须掌握 / 以后再学 / 暂时不用

    一张分类表,避免你现在就去堆工具。

    基础必学Main / 主干

  • 6.6重点展开

    怎么判断你的流程太重了,以及怎么砍

    三个可判定信号:任务单比代码长、连续 3 次在同一步走过场、为走流程而推迟开始。附「砍流程」的操作步骤。

    基础必学Main / 主干

附录

  • 三个案例的完整档案

    案例 A 知识库加搜索(从模糊想法开始)、案例 B 已有项目定位 Bug 到回归测试、案例 C 跨文件重构与批量迁移。每个都展示原始需求 → 遗漏分析 → 关键澄清对话 → 任务单 → 计划及批注 → 实施切片 → 验证 → 审查 → 交付 → 复盘,并附「换成你自己的项目怎么做」。

    三个案例是教学设计案例,不是真实交付记录,正文开头显著标注。

  • 提示词与模板全集

    6 个核心模板,中英对照,刻意做小。

  • 来源清单与核对方法

    每条含标题、作者或机构、发布时间、访问日期、链接与证据类型。

    其中 11 个证据缺口保持列出而不填平:用搜索摘要补细节会违反本书的证据规则。

  • 双工具能力对照表

    Codex 与 Claude Code 在 9 个维度的对照,附 Cursor / Copilot 参考列,以及「以官方文档为准」的复核入口。

Evidence / 方法与证据

先说清楚一条结论
凭什么该被相信。

  1. 默认档位是轻的

    多数教程给你一套完整流程然后说「按需简化」,但没人会简化。这里反过来:默认最轻,重的部分靠可判定的触发器启动。

  2. 每个机制都要回答「怎么验证它生效」

    你配了规则文件但 AI 不遵守,多数教程不告诉你怎么诊断。这里每种机制都必须给出验证手段。

  3. 收录反面证据

    有受控研究显示 AI 工具在特定条件下让资深开发者变慢,也有大样本调研显示 AI 会放大组织既有的强项和缺陷。用来校准期待和度量方式,不是唱反调。

  4. 区分「官方文档说的」和「我建议的」

    所有把企业做法改编成个人做法的地方都分开写,不混在一起。

五种证据标记

标记含义该怎么对待
官方文档产品方发布的当前文档可以照做,但注意核对日期,这类内容变化最快。
团队自述企业工程博客的自我描述说明「他们怎么做」,不能当作「这么做有效」的独立证明。
受控研究随机对照实验、大样本调研用于校准期待,必须看清适用范围和测量口径。
作者经验个人开发者的公开文章一种可行做法,样本为一,别当普适规律。
我的建议教材作者的综合判断与改编会尽量说明理由,但可能错,你自己判断。

贯穿全书的练习项目

mynotes一个 Markdown 个人知识库站点,第 2.1 章给出从零搭建步骤,约 15 分钟。三个案例都在它上面做。

方法不绑定这套技术栈。出现具体框架只是为了让命令能真的跑起来;换成别的服务端框架,流程一模一样。

核对日期与模拟标注

所有涉及产品当前实现的描述都注明核对日期 2026-09-08 与官方文档链接;实现会变,以你阅读时的官方文档为准。

所有教学对话、命令输出与测试结果均为设计的示例并标注为模拟,不把未执行的内容写成执行记录。

回到学习空间