Ctrl+D 收藏本站 再次访问不迷路 ~
📰 来源:Towards Data Science | 📅 翻译日期:2026年6月24日
🔗 原文:查看原文
🤖 翻译:DeepSeek AI · 仅供参考
为何要使用循环?
首先,我们探讨为什么在编码代理(coding agents)中使用循环。最简单的答案是:循环让你能完成更多工作。
原因是,当你设置一个循环时,代理更能自主地端到端完成任务,从而解放你的时间,让你可以处理更多事务。
想象以下两种场景:
- 场景1:你启动代理A,制定计划并开始工作。接着启动代理B,但在你与代理B规划完任务之前,代理A就开始询问问题或告知你它已完成部分工作需要验证。你决定先完成代理B,但刚结束,代理A又需要你的输入。如此往复,你同时只能与两个代理交互,实际只能完成两个任务。
- 场景2:你启动代理A,让它运行一个自我验证循环(self-verifying loop)。代理A开始工作,你告诉它只有完成任务后才能返回。指示完代理A后,你可以对代理B做同样的事:设定目标并让它进入循环工作。这次,代理A不会再打断你索取更多输入,因为它拥有自我验证循环,不再需要同样的输入。于是你可以继续为代理C、D、E等设定任务,直到代理A完成工作。
结论是:场景2让你能启动更多代理并完成更多任务,这无疑极具价值,因为它让你同时处理更多工作。
如何让代理进入循环?
现在关键问题是:如何实际使用循环?有许多方法,这里介绍最简单的技巧,你可以立即实施。
使用 Claude Code 或 Codex 中的 /goal 命令:
/goal <在此定义你的目标以及如何验证>例如,我这样设置:
/goal 实现我要求的所有功能。通过 Playwright MCP 在浏览器中点击以端到端验证。仅通过集成测试来测试应用是不可接受的,你必须实际点击应用。持续测试直到一切正常。遇到任何问题先修复,然后再次执行端到端测试。运行 Codex exec 和 review 技能,让 Codex 审核并批准,不断迭代直到获得批准。当 Codex 批准后,来告诉我可以在哪些服务器上测试以及具体如何测试。本质上,/goal 实现了一个 钩子(hook)。每当 Claude Code 或 Codex 完成一项工作,这个钩子会触发,让编码代理反思是否完成了 /goal 中定义的任务。如果完成,它会回来通知你;如果尚未完成,它会继续工作直到目标达成,或它认为目标完全不可达。
这是让编码代理更长时间工作、更自主、完成更多任务的强大方式。另外,注意在我的提示中,给了代理很多关于如何验证工作的额外信息。下一节将讨论这个主题,因为它对充分发挥 /goal 命令的作用至关重要。
让 /goal 更有效
本节将介绍如何让 /goal 命令更有效。当然,你可以只给代理设定一个目标,但如果你不仔细设定目标以及代理验证目标的方式,就不会得到好结果。
你需要为代理提供验证自身工作并最小化错误几率的方法。我主要通过两种方式实现:
- 让代理使用 Playwright MCP 与浏览器交互,进行端到端验证
- 让代理运行 Codex Exec 审查它提供的代码,以最小化错误几率
关于第一点:我使用 Playwright MCP,但你可以使用任意浏览器交互方法。我喜欢 Playwright,因为它运行良好,代理能完成所有工作。告诉代理进行端到端验证非常有效,因为代理会进入浏览器或我的应用,截图并验证一切是否按预期工作。这是一个强大且简单的改变,至少能让工作效率翻倍。
📌 *本文由 DeepSeek AI 自动翻译排版,如有不准确之处欢迎指正*
🏠 [返回首页](https://www.suiyuanlu.cn) · 📖 [查看原文](https://towardsdatascience.com/how-to-create-powerful-loops-in-claude-code/)
©版权声明
文章版权归作者所有,未经允许请勿转载。
THE END
评论已关闭