技术干货把长任务塞进一个 prompt 必翻车:拆成可回滚子 Agent,关键节点人工验收
智能体长任务频繁中途崩溃,核心并非模型能力不足,而是任务执行方法存在漏洞,长任务链易因模型输出不确定性、单步失误全盘崩塌。文章提出三套优化方案:将大任务拆解为原子子任务,通过状态持久化、检查点回滚实现断点续跑;删除、部署等高危动作增设人工验收节点;搭建主代理、子代理、人工验收的三层架构,搭配任务契约规范边界。同时结合企业实践,说明依托进度文件、Git 版本管控和独立验收智能体,可有效解决长任务执行失效、过早判定完成等问题。