我第一次看到“Loop Engineering”这个说法时,觉得它更像是给一组旧方法换了个名字。自动研究、自动测试和评审回路,本来就在做同一件事:根据结果决定下一轮。
放到 Agent 上,流程可以写得很短:人给目标和边界;Agent 执行并留下证据;失败就修正或回滚;达到停止条件后,把报告交给人。
关键不在多跑几轮,而在每一轮都留下判断依据。
一次性回答的问题
Demo 里,一次漂亮输出就够了。拿去做真实任务时,研究会漏来源,代码会漏测试,页面会在移动端出问题。没有检查标准,Agent 只是换一种方式重复生成。
所以我会先写清楚什么算完成、哪些证据必须保留、最多允许几轮,以及什么时候必须让人介入。
我现在怎么用
Pi Company 用任务和评审门管理多个 Agent;Pi Fusion 保留参与模型、Judge 和证据记录;Vizual 则把结果放进可以继续操作的界面。三个项目做法不同,但都需要一条能检查的工作链。