尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Plate 仓库的 Continue Skill 实战指南:用四类裁决治理长运行 Agent 循环

Plate 仓库的 Continue Skill 实战指南:用四类裁决治理长运行 Agent 循环 Plate 仓库的 Continue Skill 实战指南用四类裁决治理长运行 Agent 循环【免费下载链接】plateRich-text editor with AI and shadcn/ui项目地址: https://gitcode.com/GitHub_Trending/pl/plate导读本文讲解 plate 仓库 Agent 技能体系中的一个关键环节.agents/skills/continue/SKILL.md其规则源头为 .agents/rules/continue.mdc。该 Skill 定义了 Agent 在完成一轮执行切片execution slice之后如何重新评估当前战术是否仍然服务于用户的北极星目标并据此做出「继续、转向、重新规划、停止」四类裁决。它解决的是长运行自动化循环中最常见的失控问题Agent 不停地在局部打补丁、计划过期却不更新、证据不足却宣称完成。读完本文你将掌握这套「进度治理器progress governor」的完整机制——包括默认偏差、可变状态文件规则、完成守卫、七条升级规则、四类裁决的输出格式以及它与docs/plans计划文件、autogoal生命周期内核和check-complete.mjs机械门禁之间的配合方式可直接用于为任何长任务 Agent 工作流设计不撒谎的进度闭环。一、定位它是进度治理器不是状态更新continueSkill 的第一原则是定位区分This is a progress governor, not a status update.它在一段有意义的执行切片之后被调用作用是让长运行的工作保持诚实keep long-running work honest。其职责可以压缩成一句话、四个分支continue继续当当前战术仍然正确时pivot转向当负责人owner发生变化时replan重新规划当计划变陈旧时stop停止仅当当前通道lane已完成或确实被阻塞时。这与仓库中的其他 Skill 形成互补.agents/skills/status/SKILL.md负责快照式展示当前目标计划状态阶段、进度、清单、验证、风险回答我在哪里而continue负责决策式地推进下一步回答我接下来该怎么走、要不要换路。两者一个看状态一个做治理。二、默认偏差保护北极星而不是当前战术文档给出六条默认偏差Default Bias它们是所有裁决的价值观前提保护北极星目标而不是当前战术保护原则栈principle stack而不是最快的局部胜利倾向于一个持久的负责人级修复而不是许多局部补丁宁可更早升级问题escalate earlier而不是等感觉舒服了再说把测试、测量、文档、截图当作证据而非真理本身当存在安全的下一步时保持前进。这些偏差直接决定了后文升级规则的优先级排序。理解它们的顺序很重要北极星 原则栈 持久修复 提前升级 证据审视 持续前进。当一条局部胜利与更高优先级原则冲突时它就不是干净的胜利。三、Read First只读决定下一步所需的信息文档明确禁止依赖聊天历史来获取持久状态Do not rely on chat history for durable state. If it matters, read it from disk.。每次裁决前按需读取以下内容用户的当前目标活跃计划或可变状态文件最新的验证或证据剩余的负责人清单或阻塞清单承载当前问题的文件或文档任何定义了原则栈的架构/研究/上下文文档状态文件中记录的之前失败的战术完成状态文件中的current_pass、current_pass_status、current_pass_skill若存在。这条规则与 plate 仓库的实际情况高度一致docs/plans/下存在大量按日期命名的目标计划文件例如docs/plans/2026-04-08-slate-v2-batch3-core-oracle-public-surface-audit.md每个文件都承载目标、阈值、证据、风险与重启状态。continue要求 Agent 从这些磁盘文件而非对话记录中恢复上下文保证在压缩compaction或中断后仍能接续工作。四、可变状态规则先读最窄状态文件裁决后同回合更新规则分三步决策前读取当前通道最窄的活跃状态文件每次给出裁决后在同一个回合内更新同一个文件状态文件必须记录以下字段字段说明current goal当前目标scope lock范围锁定current tactic当前战术current owner classification当前负责人分类latest evidence最新证据commands or checks run运行过的命令或检查artifacts or outputs produced产生的产物或输出files changed变更的文件rejected tactics and why被拒绝的战术及原因accepted or deferred risks已接受或推迟的风险next concrete move下一个具体动作文档给出状态文件的默认存放位置Good default homes用户指定的活跃计划当前的完成/状态文件项目使用计划文件时的docs/plans/*.mddocs/**、.agents/**或项目任务目录下的聚焦负责人文档项目专属的执行账本。同时有一条反模式警告一旦工作已经收窄到某个更具体的负责人就不要继续更新一个过时的宽泛计划Do not keep updating a stale broad plan once the work has moved to a narrower owner。这与仓库中docs/plans/templates/task.md的Per-PR task ownership每个 PR 一个专属计划思想一脉相承。五、Current Pass Skill 规则当前通过未关闭不跳过负责人如果活跃状态文件记录了current_pass_skill且current_pass_status为pending、in_progress或revise则必须在决策下一步之前加载该 Skill。若current_pass_skill缺失但current_pass命名了一个已知 Skill则推断路径为.agents/skills/current_pass/SKILL.md当文件存在时并在状态文件中显式记录该路径。两个硬性约束当前通过仍处于 pending、进行中或待修订时不得跳到下一个负责人当前通过关闭时在同一状态文件中更新current_pass_status、证据指针evidence pointer与next_pass只要还有后续通过或可运行的负责人顶层status保持pending。这一机制与.agents/skills/autogoal/SKILL.md的 pass-gated goals 理念一致一个通道内有多轮 pass如 current-state read、issue discovery、research refresh、steelman、revision、verification sweep、closure每一轮都要有明确的运行与关闭纪律。六、完成守卫绿勾只是证据不是完成文档对何时可以宣称完成给出严格的守卫条件。当状态文件仍列出以下任何一项时不得调用完成未关闭的必需负责人未解决的阻塞缺失必需声明的证明尚未真正被接受的已接受风险决策已知的用户路径、产品、API、可访问性、安全、数据或架构风险而没有决策。三条关键语义绿勾是证据。除非必需负责人清单为空或被显式重新分类绿勾不构成完成。不要因为写了检查点就停止。如果检查点里有Next move且没有硬阻塞就执行它。blocked是终止停止状态不是部分切片交接状态。只有在必需证据、工具、访问权限或用户决策缺失导致任何自主进展都不可能时才使用blocked。只要范围内任一负责人仍有可运行的下一步状态就是pending——即使当前切片已验证、某个聚焦门禁已通过、或剩余工作很大。这条守卫在仓库中有机械化的执行工具.agents/skills/autogoal/scripts/check-complete.mjs。该脚本会校验目标计划文件必须位于docs/plans/下且必须满足Objective、Completion threshold、Verification surface、Constraints、Boundaries、Blocked condition六个段落均为具体内容拒绝TODO、TBD、纯pending占位Work Checklist无未勾选项Start Gates/Completion Gates表必须包含gate、applies、evidence列且每行已解析Phase / pass table无开放状态Verification evidence、Reboot status、Open risks均有具体记录。正如脚本帮助文本所强调的它只是机械门禁不替代测试、浏览器证明、源码审计或产物验证。七、七个核心问题回答要直白文档要求每个裁决周期直白地回答七个问题当前战术仍是最高杠杆路径吗我们是不是在修补错误的负责人我们是在为局部舒适优化还是为最终状态真相优化上一个胜利是否绕过了更高优先级的原则当前计划是否已过期让下一步安全的最小证明是什么如果重复该战术它真的能推动真正的负责人吗如果 2、3、4、5 中任意一个是是就 pivot 或 replan。这套问题把决策从感觉拉回证据与负责人归属是后续升级规则的思想基础。八、七条升级规则从局部症状到深层负责人Rule 1: Cluster Beats Anecdote集群胜过轶事当剩余工作的一个有意义的集群指向同一个负责人时在反证之前把该负责人当作问题本身。集群一旦明显就不要再追逐分散的局部症状。Rule 2: Patch Limit补丁上限围绕同一个负责人做了两三次局部修复之后停止收割小胜利升级到更深的负责人。这直接呼应了文档 Tone 部分的例子——This tactic is tapped out这个战术已经耗尽。Rule 3: Principle Stack Wins原则栈获胜如果局部胜利违反了更高优先级的原则它就不是干净的胜利。文档列出常见的高优先级原则正确性、用户体验、可访问性、安全性、数据完整性、公共 API 完整性、架构边界、可维护性、产品意图。处理方式只有三种门禁它gate、重做它rework、砍掉它cut。Rule 4: Source Of Truth Wins真相来源获胜决定下一步时优先级从高到低为用户目标 活跃计划 当前证据 源码 原则栈 局部胜利。具体映射为用户目标胜过局部偏好活跃计划胜过过期的聊天记忆当前证据胜过乐观主义源码胜过散文式声明原则栈胜过局部胜利。Rule 5: Evidence Is Not A Commandment证据不是戒律测试、示例、文档和测量都可能错误或过窄。要质疑任何编码了以下问题的行row过时的假设、不等价的比较、测试台噪声、比真实目标更窄的行为、与北极星冲突的架构。对坏证据做四类分类keep保留、rewrite重写、narrow收窄、cut删除。Rule 6: Simulation Is Not User Proof模拟不是用户证明合成证据只能证明其自身范围。如果声明面向用户关闭前需要用户路径或集成证明。这与仓库在编辑器行为治理中的browser proof 优先路线一致大量计划文件要求截图、Playwright、浏览器插件等真实浏览器证据。Rule 7: Research Can Upgrade The Owner研究可以升级负责人如果研究或架构评审暴露了更强的路径即使当前战术已有局部胜利也要重新规划。目标是最好的持久结果而不是到绿勾的最短路径。九、最早门禁每个切片都要有安全门与进度门每个切片都应识别被触碰负责人的最早安全门禁earliest safety gate北极星声明的最早进度门禁earliest progress gate若尚无诚实门禁则识别第一个缺失的门禁。时间约束分两个阶段第一个里程碑之前粗略门禁可以接受但缺失负责人不可接受第一个里程碑之后每个有风险的切片都需要可重复的门禁缺失的门禁成为活跃工作而非未来打磨。同时要保持三条线的分离不允许一条通道的胜利掩盖另一条通道的回归回归底线regression floor改进/进度声明improvement/progress claim用户/产品/API 契约user/product/API contract。仓库中的docs/plans/templates/task.md就是这套思想的物化它包含Start Gates表如 Skill analysis、Active goal checked、Source of truth read、TDD decision、Branch decision、Output budget strategy 等近二十个门禁行、Completion Gates表Named verification threshold、Bug reproduced before fix、TypeScript typecheck、Autoreview、PR create or update、Goal plan complete 等二十余个门禁行以及Phase / pass tableIntake → Implementation → Verification → PR/tracker sync → Closeout。每个门禁行都必须解析Applies与Evidence这正对应check-complete.mjs对门禁表的机械校验。十、四类裁决何时用、怎么用Keep Course保持航向适用条件当前战术仍是最佳路径最新证据确实推动了真正的负责人风险已加门禁或在被触碰路径之外。裁决后立即继续。Pivot转向适用条件当前战术产生了有用证据但剩余负责人已转移到别处某一行或某个假设需要被砍掉或重写局部胜利暴露了更深的风险。裁决后立即执行更好的下一步除非真的缺一个决策。Replan重新规划适用条件计划已过期所有权已变更范围或成功标准已变更当前战术在优化错误的东西当前计划与原则栈冲突。裁决后先更新计划再执行第一个新动作除非被阻塞。Stop停止仅在以下情况使用活跃计划下通道已完成所有剩余工作被显式接受或推迟硬阻塞阻止了一切自主进展用户明确要求暂停。明确禁止在以下情况停止裁决是 pivot、裁决是 replan、有风险的/开放的通道仍已知下一个负责人、检查点命名了下一步。停止前必须用停止原因更新可变状态文件若循环使用完成状态文件先更新它剩余自主工作用status: pending通道完成用status: done仅当无法自主进展时用status: blocked绝不在检查点命名了可运行的下一步时使用status: blocked。十一、输出格式短而锋利七个必备字段文档要求输出保持简短锋利始终包含Verdict: keep course / pivot / replan / stop Harsh take: 一句直白的话 Why: 1-3 条具体要点 Risks: 被触碰的风险或 none known Earliest gates: 安全门禁 进度门禁 Next move: 具体动作 Do not do: 停止浪费时间的事并强调这是里程碑更新milestone update不是交接handoff。如果裁决不是 stop就在同一回合执行下一步。文档给出的完整示例pivot 场景Verdict: pivot Harsh take: the local fixes bought the easy wins, but the remaining failures prove the owner is deeper. Why: - the same behavior family is still red after three local fixes - the latest change moved symptoms, not the owner - the active plan values end-state correctness over preserving this implementation shape Risks: - changing the deeper owner can affect existing callers Earliest gates: - safety: focused contract test for the owner - progress: focused reproduction for the remaining red family Next move: - fix the deeper owner and rerun the focused contract gate Do not do: - do not patch more callers around the same owner这个示例完整展示了 Rule 2补丁上限如何转化为一条可执行的裁决三次局部修复后同一行为族仍然红色 → 升级到更深负责人 → 用聚焦契约测试作为安全门禁。它可以在 plate 的docs/plans/*.md文件中直接落地为Current verdict段的内容docs/plans/templates/task.md中就预留了verdict、confidence、next owner、reason等字段。十二、状态更新清单追加而非重写更新可变状态文件时追加以下内容执行的确切动作收集的证据运行的命令/检查产物路径若有被测试的假设决策keep / pivot / replan / cut / defer / accept负责人分类变更的文件被拒绝的战术及原因下一个具体动作。注意决策枚举比四类裁决更细多了 cut / defer / accept它服务于状态文件作为持久记忆的职能即使某个决定不改变航向也要被记录供后续 Read First 步骤尤其是之前失败的战术使用。十三、语气规范拒绝含糊要求直白文档给出了明确的语气正反例坏的表达There are several tradeoffs to consider.It may be worth exploring.A possible option is...好的表达This tactic is tapped out.We are patching the wrong owner.The number is green, but the architecture is wrong. Replan.This wins locally by bypassing the user contract. Gate it or cut it.这套语气规范保证了continue的输出对人和对后续执行都是可判定的没有可能值得考虑这类无法执行的措辞每个结论都指向明确动作。十四、与仓库其他 Skill 体系的协作关系从源码结构看continue处于 plate 仓库 Agent 治理体系的中层上层是 .agents/skills/autogoal/SKILL.md目标生命周期内核负责客观形状、可测完成阈值、证据标准、阻塞与完成规则以及何时该update_goal(status: complete)中间是本 Skillcontinue在每个执行切片后决定战术走向是连接目标与执行的转向盘下层是具体的执行类 Skill如.agents/skills/plate-plugin-creator/SKILL.md、.agents/skills/resolve-slate-issue/SKILL.md等以及docs/plans/templates/下的项目模板。continue依赖的current_pass/current_pass_status/current_pass_skill字段与autogoal的 pass-gated 通道设计直接对接它要求的状态文件更新正是autogoal要求的生成计划即运行时真相的具体执行而它的完成守卫与check-complete.mjs的机械校验互为表里——前者是语义守卫后者是语法守卫。十五、落地建议如何在自己的长任务循环中启用该机制基于本文梳理的完整机制在 plate 仓库内或借鉴其结构落地时可按以下步骤准备状态文件为每个活跃通道在docs/plans/下创建计划文件可借助node .agents/skills/autogoal/scripts/create-goal-scratchpad.mjs --template task生成参见 docs/plans/templates/task.md或沿用已有的完成/状态文件执行切片后调用 continue运行完一段有意义的工作后按 Read First 清单读取目标、计划、证据、负责人与阻塞清单给出七字段输出Verdict / Harsh take / Why / Risks / Earliest gates / Next move / Do not do语气按 Tone 规范同回合更新状态文件追加 State Update Checklist 所列字段绝不在裁决后不落盘用机械门禁兜底关闭前运行node .agents/skills/autogoal/scripts/check-complete.mjs docs/plans/goal-plan.md确保清单、门禁表、阶段表、验证证据、重启状态、风险均已解析遵守终止语义只有通道完成、风险被显式接受、或硬阻塞阻止一切自主进展时才 stopblocked只用于无法自主前进的终态。结语continue是一份把长运行 Agent 如何自我治理讲得极其具体的方法论文档它用四类裁决收敛决策空间用可变状态文件保证决策可审计用完成守卫防止虚假完成用七条升级规则把局部症状逼向深层负责人再用七字段输出让每次裁决都可执行、可追溯。它与 plate 仓库的docs/plans计划体系、autogoal生命周期内核和check-complete.mjs机械门禁共同构成一套完整的目标—执行—验证—关闭闭环。对于任何需要长时间自主运行的 Agent 工作流这套机制都值得直接借鉴——核心只有一句话保护北极星而不是保护当前战术用证据和负责人说话而不是用乐观主义。【免费下载链接】plateRich-text editor with AI and shadcn/ui项目地址: https://gitcode.com/GitHub_Trending/pl/plate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表