附录 H:Agent 落地工程师能力自测题与 L1–L5 打分表

这是全书的脊柱自评。读书前先打一次分,记下你的起点;读完(并做完一个真实 PoC)再打一次,看自己爬了几级。本附录也可作为对应认证考核的能力自评参考。

如果你是老板或高管,这套四顶帽子 × L1–L5 的打分表你同样该用——不是用来考自己会不会写代码,而是用来给你自己的企业打分:对照每一顶帽子,看看「我的企业准备好落地 Agent 了吗」,哪顶帽子还空着、哪级能力还没长出来。它直接回答你两个决策问题:其一,我现在配的团队能不能扛住落地(帽子空着的那块,就是该招人或找外部补的缺口);其二,我该先投哪个场景(从 L1 单点试点起步,还是已具备冲 L4/L5 的基础)。老板不必会填技术细节,但要在每次 AI 立项评审时,拿着这张表问团队:「这四顶帽子,我们此刻各到第几级?短板在哪,谁来补?」

Agent 落地工程师成熟度阶梯 L1–L5

级别能力描述判定标志
L1会用开箱工具做 Demo能用 Dify / Coze / n8n 搭出一个能跑的 bot
L2能拆场景、做需求共创能独立填出场景卡,把模糊需求变成可验证假设
L3能独立交付一个 PoC 并验收有 Golden Dataset、有验收指标、过了门禁
L4能带敏捷小组 + AIBP 共创能跑通周度 Sprint,协调数据 / 模型 / 工程 / 验收
L5能交接到业务方自主运营交付配置化界面,Agent 落地工程师只做监控与阶段性升级

四顶帽子 × L1–L5 打分表

每顶帽子按 1–5 自评(对应能达到的最高级),填两次:读前 / 读后。

能力(帽子)关键问题读前读后
业务咨询师我能把「想做个 AI」翻译成可验证的业务假设吗?
架构操盘手我能独立设计 PoC 架构并选对工具吗?
AI 驯化师我能定义「什么叫准」并持续调优吗?
监控运维官我能让 AI 合规上线、可观测、可回滚吗?
组织协作我能带 2–4 人小组和 AIBP 高频共创吗?

总分 5–10 偏 L1–L2,11–17 偏 L3,18–22 偏 L4,23–25 偏 L5。分数不是目的,短板才是下一步该练的

自测题(每题对应正文章节)

回答自测题时,尽量不要只写「我理解了」,而是附上交付证据。Agent 落地工程师的成熟度要靠产物证明。

题型建议证据
需求类访谈记录、场景卡、价值假设
流程类AI 介入点图、阶段节拍图、变更池
技术类架构图、Agentic Loop 图、资产目录
评估类Golden Dataset、指标定义、回归报告
上线类门禁表、回滚演练记录、审计字段
交接类操作手册、配置变更记录、运营看板

模块 1 · 认清 Agent 落地工程师

  1. Agent 落地工程师和开发工程师、算法工程师、售前、咨询顾问的核心区别分别是什么?(前言 / 第 4 章)
  2. 「从 Code-First 到 Value-First」在你手头的项目里具体意味着改什么?(第 5 章 / 第 8 章)

模块 2 · 接住需求

  1. 业务方说「我想做个知识库」,你会先问哪三个问题?(第 5 章)
  2. 用附录 A 场景卡,为你自己的一个真实场景填满,标出 ❓ 待对齐项。(第 6 章)
  3. 怎么向不懂技术的高层解释「AI 有 5% 会答错」而不吓跑他?(第 7 章)

模块 3 · 组队跑流程

  1. 你的敏捷小组该有哪几个角色?谁提供 Ground Truth?(第 18、19 章)
  2. 四个阶段各自「进入下一阶段」的门槛是什么?(第 20 章)

模块 4 · 造出 PoC

  1. 同一个需求,三层 PoC 路径你会怎么选起点?(第 17 章)
  2. 你的 PoC 的 Golden Dataset 有没有 ≥5 条高风险样本?(第 22 章、附录 D)
  3. 用方案设计六要素,把一个场景补全。(第 16 章)

模块 5 · 验收交接运营

  1. 上线门禁(附录 F)里,你的项目现在有几项没打勾?(第 23 章)
  2. 要让 AIBP 自主运营,你需要交付哪些配置化能力?(第 24 章)
  3. 给你的 PoC 写一版 5 分钟路演脚本:痛点 → 价值 → 验证 → 投产路径 → 风险控制。(第 25 章)

本模板对应正文:前言(首次自评)、第 4 章(阶梯定义)、第 25 章(末次复评与交付包总装)。