Qwen Code近期支持通过消息中的预算标记为当前轮设置Token上限,并让已保存工作流按名称运行。对Agent编程来说,这不是简单的“少说一点”,而是为调查、规划、调用子Agent和验收建立资源边界。预算太低会导致任务半途停止,预算无限则可能在错误方向上持续消耗,因此需要按任务阶段分配。
一、Token预算解决什么问题
Agent会读取文件、搜索、调用工具、生成代码并复查,长任务的消耗很难从一句提示预估。设置上限可以防止异常循环和范围失控,也让团队在执行前讨论任务价值。预算是保护栏,不是质量保证;模型在额度内仍可能做错,因此权限和验证不能省略。
二、先小预算调查再决定执行
第一轮只让Agent定位相关模块、接口和风险,使用较小预算并禁止修改。拿到调查结果后,人类确认方向,再给实施阶段单独额度。这样比一开始授予巨大预算更安全,也能发现需求不清或仓库信息不足的问题,避免在错误假设上生成大量代码。
三、按阶段分配而不是平均分
任务可拆成理解、方案、实现和验证四段。理解阶段需要阅读,方案阶段需要比较,实现阶段产生修改,验证阶段需要运行检查。每段消耗不同,应根据仓库规模和风险调整。预算达到上限时要求Agent总结已完成内容、未完成项和下一步,而不是直接丢失上下文。
四、工作流变化后重新授权
Qwen Code对工作流权限确认与具体版本绑定,流程内容发生变化后会再次请求授权。这是必要的安全机制,因为新增一步可能意味着访问新目录或执行新命令。团队不应为了减少弹窗长期开启最大权限,应审阅差异,只批准当前任务真正需要的工具。
五、子Agent消耗也要计入总账
把任务交给外部或内置子Agent并不会免费。主Agent应明确每个子任务的目标、只读范围和输出长度,避免多个Agent重复读取整个仓库。并行调查适合互不重叠的问题,多个Agent同时修改同一文件则容易制造冲突和浪费。
六、什么情况下应该追加预算
当Agent已经提供清晰证据、方向正确且剩余工作可量化时,可以追加额度。若它反复尝试相同命令、无法找到入口或持续扩大范围,应先停止并重新定义任务。追加预算前查看当前产出,不要把资源不足与方案错误混为一谈。
七、记录每类任务的真实成本
保存任务类型、仓库规模、预算、实际消耗、完成状态和人工返工时间。经过一段时间后,可以为缺陷修复、页面调整和架构分析建立默认区间。只统计Token会忽略开发者等待和审阅成本,最终应关注一次合格交付的综合费用。
八、推荐的团队使用规则
低风险调查默认小额度和只读;涉及写入时先输出计划;数据库、权限与部署必须人工批准;达到上限时交付状态摘要;成功任务沉淀为版本化工作流。Token上限真正的价值,是让Agent从“尽量一直做”转为“在明确资源内完成可审查成果”。