### [Agent 开发者技能树:从工具契约到评测与值班](https://alyyhw.com/article/10345) **Published:** 2026-08-10T19:56:41 **Author:** AI菜鸟网 **Excerpt:** 面向「agent开发者」的能力模型、作品集与工程习惯,强调可测与安全。 「agent开发者」关注点通常是:技能树怎么长、作品集怎么做、工程习惯是什么。Agent 开发者不是只写提示词的人,而是**能把不确定推理关进可测系统**的人。 ![Agent 开发者技能树:从工具契约到评测与值班](https://login.alyyhw.com/wp-content/uploads/2026/08/26-1200x950-1.jpg) Agent 开发者技能树:从工具契约到评测与值班 ## 一、技能树 | 层级 | 能力 | | --- | --- | | 基础 | API、JSON、日志、权限意识 | | 核心 | 状态机、工具契约、评测集 | | 进阶 | 检索、多角色、可观测、成本治理 | | 协作 | 产品化需求、安全评审、值班 | ## 二、作品集建议 1. 一个只读 Agent 任务(有前后对比数据); 2. 一个带闸门的写入任务; 3. 一份事故复盘(越权被拦下的例子更好); 4. 评测报告:集大小、通过线、失败分类。 ## 三、日常工程习惯 - 工具变更必测; - 提示词进版本库; - 生产默认最小权限; - 费用与错误率进看板。 ## 落地记录表 围绕「Agent 开发者技能树:从工具契约到评测与值班」完成任务后请记录,便于四周复盘: | 字段 | 说明 | | --- | --- | | 日期 | 任务日 | | 目标 | 一句话可验收结果 | | 材料 | 来源链接或系统 | | 工具权限 | 实际用到的白名单能力 | | 人工闸门 | 必须人确认的步骤 | | 评分 | 1-5 与理由 | | 失败归因 | 材料/权限/提示词/模型/流程 | | 下轮只改一项 | 一条可执行改进 | 管理重点是返工率、事故率与单次成功成本是否下降,而不是功能清单变长。把高频失败写回模板,系统才会越用越稳。 ## 两周试点排期 将「Agent 开发者技能树:从工具契约到评测与值班」从个人尝试推到小组时,建议十个工作日: 1. 第1天:定唯一场景与成功标准。 2. 第2天:脱敏材料包与黄金样例。 3. 第3-4天:只读工具跑通。 4. 第5天:检查清单与越权拒绝演练。 5. 第6-8天:小流量真实任务并每日抽检。 6. 第9天:汇总失败类型,只留三条改进。 7. 第10天:书面决定扩面、维持或回退。 有日期、样例与抽检,讨论才不会停在「感觉还行」。 ## 原则备忘 - 目标先于工具,工具先于模型品牌。 - 小样本先于全量,闸门先于速度。 - 日志先于体感,回滚先于勇气。 - 权限默认拒绝,开放必须显式。 - 评估集比演示稿重要。 - 名称诚实,避免高估系统。 - 成本按成功任务计。 - 隐私合规是上线条件。 - 一人成功不等于组织就绪。 - 砍范围常常比加模型更有效。 犹豫是否加功能时先问:是否降返工、是否不增加不可追责风险。两问都「是」再投入下一轮。 **Categories:** AI编程 ---