自治Agent最让人担心的不是它停止,而是它不知道什么时候该停止。Qwen Code为Goal加入最大轮数和最大活跃时间配置,状态卡会展示已用额度,达到上限后提供收尾机会,并允许后续恢复。这个机制把无限后台运行变成有界任务,但团队仍需定义完成标准、权限和失败处理。
一、轮数与活跃时间的区别
最大轮数限制模型连续推进的步骤数量,适合防止反复试错;活跃时间只计算实际工作时长,更适合控制长时间后台任务。两者可以同时设置,先达到的条件触发停止。普通等待时间不应被误当成有效工作,因此状态卡比墙上时间更能反映任务进展。
二、上限应该怎样估算
先从历史相似任务观察平均轮数和有效时长,再留出合理缓冲。小型缺陷调查可能十轮以内,大型迁移需要分阶段建立多个Goal,而不是设置一个极大上限。第一次执行宁可保守,让Agent在收尾中说明缺口,再决定是否续期。
三、完成标准要先于自动执行
Goal应包含可验证结果,例如特定测试通过、接口返回符合契约或文档产出包含指定章节。不要只写“把系统优化好”。模糊目标会让Agent不断扩大范围,即使有时间限制也可能留下大量无关修改。明确禁止项和文件边界同样重要。
四、收尾窗口应该交付什么
达到上限后,Agent应停止新增工作,整理已经修改的文件、运行结果、未解决问题和回滚方法。若当前操作处于不一致状态,应优先恢复或明确警告。收尾不是再偷偷开启一轮开发,而是把任务变成其他人能够接手的状态。
五、Resume不是无限续杯
恢复Goal会在原任务上增加新窗口,团队应先审阅上一阶段产出。只有方向正确、剩余工作明确时才续期。若目标、权限或架构假设已经变化,应创建新任务,避免旧上下文继续影响判断。每次恢复都记录原因和新增预算。
六、前台子Agent和验收也消耗资源
Goal派出的前台子Agent以及验收检查都会计入任务消耗,因此拆分越多不一定越高效。优先把独立调查交给子Agent,避免重复读取。验收过大时可分批执行,但应保留整体关键路径检查,防止局部通过而系统失败。
七、权限与停止必须独立
时间或轮数上限不能替代最小权限。即使只运行五分钟,拥有生产删除权限的Agent仍可能造成严重后果。默认只读,写文件、执行迁移和部署分别授权;危险操作设置人工确认。紧急停止按钮应能终止工具调用,而不只是停止文本生成。
八、落地一套安全模板
任务开始前写目标、验收、禁止范围和回滚;配置轮数与活跃时间;先审批计划再执行;通过状态卡观察剩余额度;触顶后审阅收尾报告;必要时在明确理由下恢复。有限自治并不会削弱Agent能力,反而让团队敢于把更多真实任务交给它,同时保持控制和责任边界。