推文
@fireandstart · 2026-10-11 04:17
这套 25 个 agent skill 的价值,不只是把 Define、Plan、Build、Verify、Review、Ship 排成一张流程图,而是把容易被跳过的判断也写进工作流:什么时候该启用、要留下什么证据、哪些“看起来完成了”的说法需要追问。实际协作里,模型往往并不缺步骤清单,真正的问题是任务一复杂,计划被压缩、验证被口头带过,最后把“我运行过”误当成“结果可靠”。 我会特别关注它对每个阶段的退出条件怎么定义。Define 要留下可检查的需求边界;Plan 要拆成能独立验收的小任务;Build 的改动要和目标对应;Verify 应该引用真实命令与结果;Review 则要能指出具体风险和证据,而不是只给“看起来不错”。这些产物连起来,才能让下一步知道前一步到底完成了什么,也方便人类在高风险节点接手。 自动触发也很有用,但触发规则最好足够明确:进入 API 设计时启动相关技能,不代表它可以替团队决定所有架构取舍;发现安全或数据风险时,应停下来要求授权或升级审查。把流程做成可复用技能的同时,也要让边界、失败状态和人工接管点同样可见。这样“像资深工程师一样工作”才不只是更流畅地产出代码,而是每个结论都能解释、复查和追溯。
曝光 21 · 评论 0 · 点赞 0 · 书签 0