附录 H:Agent 落地工程师能力自测题与 L1–L5 打分表
这是全书的脊柱自评。读书前先打一次分,记下你的起点;读完(并做完一个真实 PoC)再打一次,看自己爬了几级。本附录也可作为对应认证考核的能力自评参考。
如果你是老板或高管,这套四顶帽子 × L1–L5 的打分表你同样该用——不是用来考自己会不会写代码,而是用来给你自己的企业打分:对照每一顶帽子,看看「我的企业准备好落地 Agent 了吗」,哪顶帽子还空着、哪级能力还没长出来。它直接回答你两个决策问题:其一,我现在配的团队能不能扛住落地(帽子空着的那块,就是该招人或找外部补的缺口);其二,我该先投哪个场景(从 L1 单点试点起步,还是已具备冲 L4/L5 的基础)。老板不必会填技术细节,但要在每次 AI 立项评审时,拿着这张表问团队:「这四顶帽子,我们此刻各到第几级?短板在哪,谁来补?」
Agent 落地工程师成熟度阶梯 L1–L5
| 级别 | 能力描述 | 判定标志 |
|---|---|---|
| L1 | 会用开箱工具做 Demo | 能用 Dify / Coze / n8n 搭出一个能跑的 bot |
| L2 | 能拆场景、做需求共创 | 能独立填出场景卡,把模糊需求变成可验证假设 |
| L3 | 能独立交付一个 PoC 并验收 | 有 Golden Dataset、有验收指标、过了门禁 |
| L4 | 能带敏捷小组 + AIBP 共创 | 能跑通周度 Sprint,协调数据 / 模型 / 工程 / 验收 |
| L5 | 能交接到业务方自主运营 | 交付配置化界面,Agent 落地工程师只做监控与阶段性升级 |
四顶帽子 × L1–L5 打分表
每顶帽子按 1–5 自评(对应能达到的最高级),填两次:读前 / 读后。
| 能力(帽子) | 关键问题 | 读前 | 读后 |
|---|---|---|---|
| 业务咨询师 | 我能把「想做个 AI」翻译成可验证的业务假设吗? | ||
| 架构操盘手 | 我能独立设计 PoC 架构并选对工具吗? | ||
| AI 驯化师 | 我能定义「什么叫准」并持续调优吗? | ||
| 监控运维官 | 我能让 AI 合规上线、可观测、可回滚吗? | ||
| 组织协作 | 我能带 2–4 人小组和 AIBP 高频共创吗? |
总分 5–10 偏 L1–L2,11–17 偏 L3,18–22 偏 L4,23–25 偏 L5。分数不是目的,短板才是下一步该练的。
自测题(每题对应正文章节)
回答自测题时,尽量不要只写「我理解了」,而是附上交付证据。Agent 落地工程师的成熟度要靠产物证明。
| 题型 | 建议证据 |
|---|---|
| 需求类 | 访谈记录、场景卡、价值假设 |
| 流程类 | AI 介入点图、阶段节拍图、变更池 |
| 技术类 | 架构图、Agentic Loop 图、资产目录 |
| 评估类 | Golden Dataset、指标定义、回归报告 |
| 上线类 | 门禁表、回滚演练记录、审计字段 |
| 交接类 | 操作手册、配置变更记录、运营看板 |
模块 1 · 认清 Agent 落地工程师
- Agent 落地工程师和开发工程师、算法工程师、售前、咨询顾问的核心区别分别是什么?(前言 / 第 4 章)
- 「从 Code-First 到 Value-First」在你手头的项目里具体意味着改什么?(第 5 章 / 第 8 章)
模块 2 · 接住需求
- 业务方说「我想做个知识库」,你会先问哪三个问题?(第 5 章)
- 用附录 A 场景卡,为你自己的一个真实场景填满,标出 ❓ 待对齐项。(第 6 章)
- 怎么向不懂技术的高层解释「AI 有 5% 会答错」而不吓跑他?(第 7 章)
模块 3 · 组队跑流程
- 你的敏捷小组该有哪几个角色?谁提供 Ground Truth?(第 18、19 章)
- 四个阶段各自「进入下一阶段」的门槛是什么?(第 20 章)
模块 4 · 造出 PoC
- 同一个需求,三层 PoC 路径你会怎么选起点?(第 17 章)
- 你的 PoC 的 Golden Dataset 有没有 ≥5 条高风险样本?(第 22 章、附录 D)
- 用方案设计六要素,把一个场景补全。(第 16 章)
模块 5 · 验收交接运营
- 上线门禁(附录 F)里,你的项目现在有几项没打勾?(第 23 章)
- 要让 AIBP 自主运营,你需要交付哪些配置化能力?(第 24 章)
- 给你的 PoC 写一版 5 分钟路演脚本:痛点 → 价值 → 验证 → 投产路径 → 风险控制。(第 25 章)
本模板对应正文:前言(首次自评)、第 4 章(阶梯定义)、第 25 章(末次复评与交付包总装)。