AI 编码代理常被当作单一工具讨论:要代码,给代码。实际有用的代理工作是有阶段的。需求不清、设计需推敲、实现进行中、工作要移交新会话,这四种场景需要不同行为。用一个巨型 prompt 解决所有阶段,通常只能得到妥协方案。
文章介绍四个针对性技能:Caveman 负责精简执行沟通,Superpowers 负责结构化开发,grill-me 负责压力测试方案,handoff 负责把进行中的任务移交新代理或新会话。它们互补,目标不是给每次编辑增加仪式,而是在最可能造成浪费的节点施加最小有效约束。
AI 辅助开发的四种失败模式
代理在理解工作前就开始编码。比如「添加组织角色」这个需求,隐藏了成员资格、权限范围、迁移、审计追踪、错误处理和发布等决策。代理可能在所有选择明确前就产出看似合理的补丁。
代理只会附和不会质疑。辅助型助手倾向接受既定框架,当框架是提案而非确定需求时很危险。需要一场能暴露依赖、追问可能失败点的访谈。
日常工作中代理话太多。方向批准后,冗长解释变成摩擦。调试、评审跟进和小实现循环中,有用输出通常是发现、变更、验证和风险说明。
会话边界丢失上下文。新代理无上下文会重复探索;带完整记录的新代理要在过时想法和工具日志中找当前状态。两者都不是可靠续作方式。
grill-me:写代码前挑战方案
手动调用的技能,一次一个问题访谈你的计划或设计,给出推荐答案并等待反馈。代码库里有事实可查时,应检查代码而不是让用户重建。适用于想法合理但未定案时,如新 API 契约、权限模型、缓存策略、工作流重设计或 schema 变更。目的不是问无穷假设,而是解决实现时可能意外做出的决策。从具体提案开始,说明目标、约束、现有产物和期望输出,先让代理检查相关文件,再逐个决策拷问计划,记录决策、非目标、开放风险和下一个要创建的产物。
Superpowers:把决策变成受控交付流程
方向明确后,Superpowers 提供更完整的开发工作流。
其仓库描述的过程:
• 代理澄清实际结果
• 开发规格和设计
• 获得批准
• 创建实现计划
• 强调真正的红绿 TDD
• 进入实现和评审。也支持有真实任务边界的子代理驱动开发。适用于错误假设代价高的场景:新功能
• 公开 API 变更
• 复杂 bug
• 行为重构
• 迁移或安全敏感变更。关键收益是存在关卡:澄清抓住错误结果,设计批准拦住糟糕形态,计划让顺序可见,红绿测试让选定行为可执行,评审把交付 diff 与批准意图对比而非只看代码是否合理
Caveman:保持执行沟通紧凑
改变代理输出风格为简洁直接。README 把目标定义为缩小代理的「嘴」而非「脑」,代码、命令和错误保持精确。项目声称减少 65% 输出 token,应视为项目声明而非通用基准。适用于重要决策已定之后:已知范围的 bug、测试失败、终端密集任务或评审跟进。要求输出根因、改动文件、验证运行、结果和剩余风险。当细微差别本身就是交付物时不适合精简模式。规则简单:减少填充,绝不减少证据。实用模式是设计批准前用正常详细度,之后切换简洁执行报告,要求代理明确阻塞点和假设。
handoff:跨边界携带进行中的线索
生成紧凑文档供新代理续作。记录在途内容、为何重要、下一步该做什么、续作建议技能。关键是不复制而是引用现有规格、计划、ADR、issue、commit 和 diff。保存到系统临时目录而非工作区,并会脱敏密钥和个人身份信息。在结束工作前、接近上下文限制、任务在代理间移动或有意重置对话时使用。好的 handoff 写明目标、已完成工作、已定决策、阻塞点、验证、权威引用和一个精确的下一步动作。「明天继续」不够;「服务层授权已完成;实现邮件发送前检查通知适配器;已批准规格在此路径;目标测试通过」才可执行。
集成工作流
先框定请求,说明期望结果、约束和非目标。用 grill-me 压力测试关联决策并检查仓库证据。用 Superpowers 把已定决策转成批准的设计、计划、测试、实现和评审。执行阶段用 Caveman 保持更新紧凑,同时保留发现、命令、测试结果和风险。转换时用 handoff,只保留可续线索并指向持久产物。并非每个任务都需要所有阶段:琐碎本地改动可能一个都不用;中型功能可能需要 Superpowers 和 Caveman;高风险设计变更可能从 grill-me 开始、以 handoff 结束。价值在于选择合适控制,而非机械调用每个工具。
如何采用这套组合
从小处开始。选一个有实质歧义的功能,让代理检查相关代码并拷问提案,要求可评审的设计和测试计划。批准后切换短执行报告。在第一个计划中的上下文切换点创建 handoff,让新代理从它继续。衡量真正重要的结果:代码前捕获了多少假设、评审者能否解释 diff 为何存在、切换后代理重复探索的频率、简洁报告是否缩短人工评审循环。不要只用 token 数或生成计划看起来多厉害来判断成功。
限制与护栏
这些技能不替代可问责的工程判断。它们不能决定产品策略、保证系统安全或证明验收标准反映真实用户需求。它们让决策、证据和转换可见。使用源码控制、评审、测试、可观测性和常规发布控制。密钥不要进入对话和 handoff。把代理建议当作决策输入,而非决策本身。
底线
可靠的 AI 辅助开发不是让代理始终表现一致。计划不确定时让它质疑,变更影响大时遵循纪律化工作流,执行清晰时简洁沟通,上下文变化时干净移交。Caveman、Superpowers、grill-me 和 handoff 各自让这套系统的一部分更锋利。
来源:Caveman 仓库、Superpowers 仓库、AI Hero 的 grill-me 与 handoff
#开发者 #工具 #AI代理 #Caveman #Superpowers #grillme #handoff #LLM #PromptEngineering #AI编程
@DevToolboxHub