autopilot
当用户说“autopilot”“自己搞定”“直接跑到底”,或委托代理调查、实施并验证一个宽泛任务时使用。仅规划、解释或已有明确窄范围的请求,按用户指定范围处理。
How do I install this agent skill?
npx skills add https://github.com/yan-labs/yan-skills --skill autopilotIs this agent skill safe to install?
- Gen Agent Trust Hubpass
The skill is a sophisticated autonomous agent coordinator for software development tasks. Its primary security risk is a large attack surface for indirect prompt injection, as it processes untrusted issue descriptions and project documentation to drive automated code changes and deployments. It also features a self-modification mechanism for updating its own rules, though this is restricted by internal audit protocols.
- Socketwarn
1 alert: gptSecurity
- Snykwarn
Risk: MEDIUM · 1 issue
What does this agent skill do?
Autopilot
把宽泛任务变成可验收的行动,并持续执行到目标达成或遇到真正的阻碍。用户的明确范围、审批要求、费用上限和项目规则优先。阶段性文字只是进展;只要仍有可执行的下一步,就继续调用工具推进。不要因为轮次长、完成了一个阶段,或已经写出总结而停止。
开始
- 读目标项目的
CLAUDE.md、AGENTS.md,检查工作树与已有任务状态。只读取与任务相关的 Skill 和参考文件。 - 用一段话写清目标、范围、验收证据、限制和下一步。复杂或需跨轮恢复的任务写入项目约定的
progress.md;短任务直接在当前轮执行,不为它创建空状态文件。 - 明确用户想要的是规划、研究、本地实现,还是发布。没有明确发布目标时,以完成用户授权的范围为准;用户说“发布/上线”时按项目规则执行并回读目标环境。
- 先核实用户报告的现象和受影响链路。没有原始事故身份时注明未知,不用构造样例冒充真实复现。
阶段选择
按依赖关系挑必要阶段,不套固定流水线:
| 任务 | 必要动作 | 完成证据 |
|---|---|---|
| 研究/排查 | 查原始资料、代码和运行状态;区分事实与推断 | 来源、时间、范围和可复核结论 |
| 代码变更 | 找到调用链与根因、最小修改、运行相关检查 | diff、检查退出码、实际行为 |
| 用户界面/真实服务流程 | 在适用环境走用户路径 | 页面或流程的真实结果;必要时附日志或数据回读 |
| 发布 | 先本地验证,再按项目发布,回读部署版本及关键行为 | 目标环境对应版本与结果 |
| 关联 Issue | 按项目流程记录改动、证据和真实终态 | Issue 当前状态与最终记录 |
独立 review 用在高风险、跨系统、安全、权限、数据迁移或复杂交互变更;简单文档和局部低风险改动可由执行者检查 diff 与相关验证。审查后若改了运行时代码,重跑受影响检查;若已发布,重发并回读。没有新 diff 不做第二轮部署。不要把本地改动自动扩成发布任务,也不要把所有代码改动强制变成两轮部署和两轮 E2E。
验收必须与结论匹配:读代码是线索,测试证明测试范围,模拟流程证明接线,目标环境的原始用户流程才支持目标环境已修复。CI 绿灯不能代替部署后行为,提交或推送不能代替线上回读。
执行与恢复
- 默认在当前轮推进。只有用户或系统明确要求持久 Goal 时,才创建或恢复 Goal;
progress.md里的目标文字不是平台 Goal。 - 需要跨轮恢复时记录已完成项、未完成项、最强证据、失败原因和一个具体下一步。确实需要等待外部事件时,使用平台实际可用的恢复机制;不能宣称安排了不存在的唤醒。
- 文本消息结束一轮不代表任务完成。尚有未完成项且没有阻碍时继续。后台命令或子 Agent 尚未返回时,等结果并纳入验收。
- 同一失败不要原样反复试。记录失败边界,改变假设、工具或范围后再试;连续两三次自动续跑仍无新证据时停止空转,报告阻碍和下一步。用户设定的上限始终生效。
- 每次结论写明证据层级和限制。不能把防御性修补说成已证实历史根因,不能把 fixture 成功说成用户事故已关闭。细节见
references/evidence-and-verification.md。
Skill 与委派
先查项目已有脚本、工具和专用 Skill;按必要阶段加载。缺少 Skill 时使用已有代码、标准工具或平台能力。任务模板见 references/phase-library.md。
只有独立子任务能清楚划分文件或资源、且委派节省总耗时,才使用子 Agent;先核对当前平台和项目对委派的要求。为每个子任务写清目标、输入、文件归属、禁区与验收,由主代理复核结果。模型路由以全局 CLAUDE.md §2 与 agent-fleet 为准,失败处置与执行纪律(第三方失败重试一次后停下告知用户、Claude subagent 不再派 Claude subagent、不设轮数与预算上限)见 references/model-and-delegation.md;并发细节见 references/concurrency-and-landing.md。
交付
提交前核对文件归属与工作树,精确暂存自己的文件,不覆盖他人改动。只清理由本任务创建且确认无恢复价值的临时产物。发布任务以目标环境回读为交付;本地任务以本地文件和相关验证为交付。关联 Issue 的终态与用户可见效果按项目规则回填。最后用中文简要报告改了什么、验证证据、实际发布状态和未完成项。
需要更细的操作约定时按任务读取:references/execution-budget.md、references/ownership-and-tracker.md、references/learning-and-audit.md。
How can the creator link this skill?
Add the canonical catalog link to the repository README so users can inspect current installs and available audits. The publishing guide covers the complete discovery path.
<a href="https://skillzs.dev/skills/yan-labs/yan-skills/autopilot">View autopilot on skillZs</a>