执行驱动交付(八):全流程操作手册——一张表,从项目启动跑到交付沉淀
执行驱动交付(EDD):AI 项目交付方法论 · 8/9
📖 摘要:前七篇分别讲了 EDD 的一个机制——一页纸边界卡、流程裁剪、一轮一刀、活文档、三道阻尼器、验收双面闸、资产复利。这篇把七块拼成一张完整地图:一个项目从启动到交付沉淀,九步怎么走、每一步谁负责、卡在哪道门禁。看完可以直接照着跑。
📌 本文要解决的核心痛点
- 原理都懂了,真接项目时第一步该干嘛?
- 交付流程有九个步骤,哪些环节省不得、哪些可以砍?
- 每步的产出是什么、谁拍板、什么情况必须停下来?
- 本文给一张全流程主表:目标 / 责任人 / 输入输出 / 门禁 / 耗时,一步一行。
场景
你刚拿到一个 AI 项目:客户要做网络设备故障诊断助手,手册几千页,值班工程师查不到答案。你懂 EDD 的原理——不写大需求文档、先跑起来、每轮一刀。但真到开工,问题变成:先做哪个?花多长时间?每一步产出什么?什么情况下要停下来找客户确认?
流程不是越多越好,也不是越少越好。EDD 的答案是九步,但每一步都有档位差异:轻量小单可以砍掉大半,资产单一步都不能省。这篇就是那张可以照着跑的主表。
结论
EDD 全流程 = 九步:需求接入 → 体检定档 → 流程配重 → 边界卡 → 选型实验 → 执行循环 → 自验证 → 双面验收 → 交付沉淀。判断在人、执行在 AI、门禁卡质量——每一步要么有产出,要么有门禁,没有「走一步看一步」。
九步拆成三段:
启动段(半天~1 天):第 0-2 步——判断活,产出纸面决策,还没碰开发
开发段(循环 N 次):第 3-7 步——主体,一轮一刀
收尾段(不参与循环):第 7-8 步——正式关卡 + 沉淀
推导链:为什么流程是「判断 / 执行 / 门禁」三维,而不是文档链
传统流程把项目拆成「文档链」:需求文档 → 设计文档 → 开发 → 测试。每份文档都是上一份的翻译,翻译错一次,错误就固化一层。
EDD 的九步不是文档链,是三个维度:
判断(人在做):边界卡拍板、介入判断、验收判定——判断权在人
执行(AI 在做):选型实验、DSL 生成、用例执行、报告初稿——执行权在 AI
门禁(机制在卡):每步的完成条件——六区块齐备才进执行、硬断言全过才进验收、严重缺陷为零才通过——不靠自觉,靠检查
一步一判断、一步一执行、一步一门禁。判断错了,执行环节会放大(第五篇的错误放大坑);门禁松了,错误会流到下一环节。这就是为什么九步的每一步都同时写着「谁负责」和「卡什么」。
实践动作:全流程主表(九步,可照着跑)
| 步骤 | 目标 | 责任人 | 输入 → 输出 | 门禁 | 耗时 |
|---|---|---|---|---|---|
| 0 需求接入 | 拿到启动所需全部信息 | 人+客户 | 需求意向 → 信息包(需求描述/客户背景/数据与环境可得性/预算期限 + 可验证项:平台版本、数据库类型、是否允许只读访问) | 四样+可验证项齐备才进下一步 | 0.5 天 |
| 1 体检定档 | 判断做不做、报多少价、什么形态 | AI 为主,人拍板 | 信息包 → 结论(做/不做/加价)+ 报价 + 交付形态 | 只读体检三前提满足才碰客户数据 | 0.5 天 |
| 2 流程配重 | 定流程深度 | 人拍板,AI 给建议 | 30 秒一问:除了钱还能留下什么?能 → 资产单;不能 → 按金额分轻量/中单 | 档位决定后面所有步骤的砍/加 | 30 秒 |
| 3 边界卡 | 锁死做什么/不做什么 | AI 起草,人拍板,客户确认 | 信息包 → 一页边界卡(六区块:档位/痛点带下刀点/边界带来源/成功标准可断言/第一刀/客户已确认项)+ 终态画面附页 | 六区块齐备 + 画面定稿或标记待验证才允许进执行 | 0.5 天 |
| 4 选型实验 | 用实测选技术方向,不靠推演 | AI 执行,人定候选 | 边界卡 → 1-3 个候选方向各跑最小样本 → 选型结论 + 客户确认点 | 选型依据可追溯(谁测的/测了什么/为什么选) | 0.5-1 天 |
| 5 执行循环 | 一轮一刀做出可运行整体 | AI 执行,人做介入判断 | 边界卡+选型结论 → 每轮:切一刀 → 冒烟 → 跑通记录(跑了什么/错什么/怎么修/留下什么约束)→ 约束喂回活文档 | 介入 ABC(报错强制介入/偏离按需介入/正确不介入);熔断四字段兜底 | 每轮 1 刀 |
| 6 收敛 → 自验证 | 收敛后正式自测 | AI 执行,人做基线确认 | 错误清单 → 用例集(错误清单→回归/成功标准→端到端/禁区→负向)+ 自验证报告 | 硬断言全过才进验收;收敛三条件齐备(目标达成/形态稳定/错误饱和) | 1-2 天 |
| 7 双面验收 | 对内终验推测项,对外出凭证 | AI 汇总,人判定,客户签字 | 用例集 → 验收报告 + 三态结论(通过/有条件通过/不通过) | 严重缺陷 = 0 才通过;推测项验证不过不许固化 | 1-2 天 |
| 8 交付沉淀 | 交付成果 + 留下资产 | AI 执行,人确认 | 验收报告 → 交付包 + 沉淀输入(新约束/新边界 → 复用库) | 验收签字在前,沉淀在后 | 0.5 天 |
一句话版:0 拿信息、1 判断做不做、2 定流程深浅、3 锁死做什么、4 实测选方向、5 一轮一刀跑、6 自测到收敛、7 双面验收、8 留下资产。
实践动作:三张简表
档位差异(流程裁剪机制,不是原则)
| 档位 | 金额参考 | 流程裁剪 |
|---|---|---|
| 轻量小单 | 千元级 | 画面口头一句 + 选型融入第一刀 + 极简验收单(10-20 条用例) |
| 中单 | 万元级 | 半页终态画面 + 完整边界卡 + 轻量选型 + 正常自验证 |
| 资产单 | 资产导向 | 全链一步不省 + 独立验收可选 + 完整报告链 |
裁剪的是流程深度,不裁剪的是边界卡——它是杠杆最高的环节,半天省不得。
人机分工(判断在人、执行在 AI)
| 环节 | 谁 | 拍板项 |
|---|---|---|
| 边界卡起草 / 终态画面反推 | AI | 六区块初稿 + 画面初稿 |
| 边界 + 成功标准 + 画面定稿 | 人 | 发客户确认 |
| 候选方向 | 人 | 列 1-3 个方向(AI 不替人选方向) |
| 选型实验 / DSL 生成 / 用例执行 / 报告初稿 | AI | 执行全链 |
| 介入判断 / 基线确认 / 验收判定 | 人 | 三步拍板 |
铁律速查(违规即流程失效)
边界卡六区块齐备才允许进执行——缺一区块,后面全是自由发挥
第一刀必须可断言——「准确率≥90%」可以,「质量好」不行
一轮只切一刀——下一刀取决于本轮暴露了什么,不预排
约束必须来自执行——凭经验写活文档 = 脑内推演,要戒掉
一次执行就沉淀 = 把未验证推测当事实——固化要过证据门槛,同时标注版本/场景/约束
严重缺陷 = 0 才通过验收——标准含糊,验收就是互相猜
客户不配合走兜底,质量门禁不降级——功能验收永不降级
边界与版本
适用边界:适合有文本化配置、能拆成可运行步骤的 AI 项目(知识库/RAG、工作流编排、Agent 应用);不适合纯 GUI 操作、无文件化平台的场景
档位金额是 2026-08 实测参考值,市场/平台变化后按校准闭环重拍
待验证项诚实标注:客户不配合兜底路径为设计稿(2026-08 讨论 v1),真实项目回填后更新;终态画面有效性同样待真实项目回填
本手册基于 Dify 1.16.x 平台实测,方法论本身不绑定平台
收尾
九步跑完,项目交付了,资产留下了。回头看这个系列:TR0 定方向 → 配重定流程 → 执行循环跑起来 → 活文档攒约束 → 阻尼器防错误 → TR4 双面闸收口 → 资产复利让下一单更便宜——现在多了这张表,你可以从第一步开始照着跑了。
EDD 一句话总结:拿客户需求做受控实验,每次交付同时产出两样东西——客户要的成果,和我们可复用的资产。
下一篇没有下篇了——系列完结。用起来,跑一单,回来告诉我哪一步卡住了。
💬 讨论区:你最近一个 AI 项目,卡在九步里的哪一步?是「边界卡没划禁区」还是「验收标准含糊」?评论区聊聊,踩过的坑最有价值。
本文基于真实项目交付经验撰写(2026-08,1 个真实交付项目与内部实战实验)。文中数据均来自实测记录,方法论部分以「已验证 / 推断待验证」标注边界。