Qwen Code在2026年7月更新中持续完善Loop自主模式:可以反复执行指定任务,并让定时任务在重启后继续;配合任务通知、成本统计和后台面板,AI编程开始具备长期运行能力。这非常适合依赖更新、日报、测试巡检和内容整理,但如果缺少状态与停止条件,也可能无限重试、重复写入或消耗大量Token。
先把目标改写成可验收任务
“持续优化项目”过于模糊,正确写法应包含范围、频率和完成标准,例如“每天9点检查三个依赖的安全公告,只在发现高危且当前版本受影响时创建工单”。Agent必须知道什么算完成、什么情况跳过、什么情况请求人工决定。
状态必须写到会话之外
长期任务不能只依赖聊天记忆。使用数据库或状态文件记录上次执行时间、处理过的唯一ID、当前阶段、失败次数和输出位置。每次开始先读取状态,成功后原子更新。这样程序重启后不会从头重复,也能判断某条新闻、提交或订单是否已经处理。
设计幂等操作
同一轮任务可能因网络超时被执行两次。创建数据前先使用来源ID或内容哈希查重;更新操作带版本条件;发送通知记录发送键;文件写入先生成临时文件再替换。幂等不是简单检查标题,因为标题可能相同但内容不同,也可能被用户修改。
限制预算和重试
为每次运行设置最大Token、最长时间、最大工具调用和最多重试次数。错误应分为可重试的网络故障、需要调整输入的数据问题和必须停止的权限错误。指数退避可以避免服务异常时高频请求。连续三次失败后暂停并通知负责人,不要让模型无限自我修复。
权限按任务最小化
检查更新只需要读权限,创建工单只允许写入指定项目,发布生产必须另外审批。不要让一个Loop同时拥有服务器root、数据库管理员和对外发送权限。执行命令使用允许清单,工作目录限制在项目范围,敏感环境变量不写入日志。
一个内容更新示例
每天抓取AI资讯时,流程应先读取已有文章标题和来源URL,再搜索可靠官方来源,选择未覆盖主题,生成正文后检查字数、引用、分类和封面。所有文章在事务中写入,任一失败整批回滚;成功后更新sitemap,并记录新增ID。下一次运行先读取这些ID,避免重复。
如何验收长期任务
在正式定时前先手动运行三次:第一次正常处理,第二次验证不会重复,第三次模拟中途失败并检查能否恢复。然后模拟重启、网络超时和权限拒绝。监控至少包括成功率、平均耗时、Token成本、重复数据数和人工接管次数。
什么时候不该自主运行
不可逆删除、财务支付、批量封号、生产数据库结构变更和法律结论不适合无人值守。Loop应负责收集、分析、准备草稿和运行安全测试,把高风险决策交给人。长期Agent的成熟标志不是永不询问,而是知道何时停止并提供足够证据。