来源:X @mvanhorn
「WTF Is a Loop? Part 2」使用 /last30days 工具对 X、TikTok、Reddit、YouTube、GitHub 做了八次检索,从一个月内真实运行的循环中筛选出十五种高价值模式,每条附带真实互动数据。其前作《WTF Is a Loop? Peter Steinberger vs. Boris Cherny》据称获得 360 万次浏览 [0]。在进入清单前,作者先纠正了一个普遍误解:Goal、Loop、Routine 并非同一事物的三种名称,而是执行逻辑根本不同的三种模式 [0]。Claude Code 官方将这套设计语言总结为四个变量——触发、停止、工件、适用场景——“四个变量一旦确定,循环的形态就确定了” [69]。
三种命令:Goal、Loop、Routine
Goal 以可验证条件为停止线。 /goal <condition> 在条件达成前跨轮持续工作,达成即停 [0]。Claude Code 在 v2.1.139 加入该命令,官方 changelog 描述为“跨轮运行任务直到设定的完成条件” [3,8]。每一轮 Agent 试图停下时,由独立评估模型核对条件,不达标则送回继续。因此确定性指标(测试通过数、分数阈值)效果最好,评估模型只需比对,无需自行裁量 [69]。目标模糊会让评估模型无所适从,表现为早停或空转 [69,4]。Codex 也提供 goal 功能 [66],素材称其 CLI v0.128.0 引入,并带 set、pause、resume、clear 控制 [0]。
Loop 是人还在场时的定时器。 /loop <interval> <prompt> 按固定间隔重复执行,前提是会话保持开启,跑在本机,关机即停 [0,69]。Claude Code 负责人 Boris Cherny 用它运行 /loop 5m /babysit 来自动处理代码评审并 rebase 自己的 PR,/loop 30m /slack-feedback 则每半小时把 PR 挂到 Slack 收集反馈 [47]。
Routine 是人不在场时的云任务。 /schedule <description> 把任务放到云端,笔记本合上也能运行 [0],对应官方文档页 “Run prompts on a schedule” [47],设计范式中明确标注“上云” [69]。Codex 一侧的等价物是 App 里的 Automations,按日、周或自定义 cron 运行独立、项目或线程自动化,结果汇总到 Triage 收件箱 [0]。两个工具目前都没有 /routine 命令——Claude Code 用 /schedule,Codex 用 Automations,用对动词是第一步 [0]。
三个命令真正的差别在于“谁决定什么时候停”:Goal 由评估模型核对条件,Loop 由用户取消或工作自然完成(PR 合并、队列清空),Routine 由云端调度 [69]。
十五种模式:三种取向
十五个案例里,十一个直接来自 X、TikTok、Reddit、GitHub 的真实发布(附互动数据),最后四个来自 Matthew Berman 的 Forward Future Loop Library 精选目录,目录的筛选信号是实用性,点赞数不作为主要依据 [0]。按用途可分成三类。
开发与质量类。 构建-测试-修复对是最常被演示的循环:构建者写代码,检查者跑测试、类型检查和 lint 并报告问题,来回传递直到干净 [0]。Boris 的验证器循环强调 Claude Code、高级模型、验证器三者同跑,逐项移除瓶颈;验证器是人人跳过的那部分 [0]。五分钟维护者是 Peter Steinberger 的做法——每五分钟做一件经过验证的小型维护,清理什么由 Agent 自行判断,不依赖写死的脚本 [0];素材称他过去 30 天以 95% 接受率合并了 859 个 PR [0]。他的真实管线与此一致:约一百个 Codex 实例常驻云端,评审 PR、查提交安全漏洞、去重 issue、写修复 [12]。生产错误扫描(目录精选)读生产日志,区分噪音与可操作错误,带测试修复并开 PR,价值全在分拣 [0]。对抗性审查(Clodex,目录精选)让 Codex 在合并前审查 Claude 的 PR,两个不同模型家族都同意才放行,--max-iter 5 与 --threshold medium 是核心参数 [0]。
架构与流程类。 计划-生成-验证-修复循环用硬性五轮上限解决跑偏问题,过程落盘,只读最终版 [0]。目标元技能把模糊需求翻译成严谨目标——结果、验证方式、禁止触碰的范围、何时停止——“你的 Agent 不笨,是你的指令太模糊” [0]。质量 streak 循环不满足于第一次绿灯,要求真实场景连续通过多次才算数,因为单次通过不足以证明可靠 [0]。补全契约在任何工作开始前先写下“完成”的定义和每条要求对应的证据,拿不到证据就拒绝声称完成 [0]。
运营与自动化类。 邮件流水线每天处理 1.5 万封酒店宾客邮件:循环收件箱、分类起草、只升级需要人介入的部分 [0]。人类审批队列把停止条件从“测试通过”换成“你的批准”——工作流暂停后发来带批准、修改、跳过按钮的消息,把人工评审本身当成有提醒和截止时间的队列 [0]。roborev 是可安装的提交后审查工具:Go 写的守护进程,装 post-commit git hook,每次提交触发后台审查,再交由 Agent 跑后台修复作业,可接 Codex、Claude Code、Gemini 等多家 Agent [29,28]——它是“验证器住进循环里”这个论点最现成的产品化版本 [0]。循环引擎模板提供现成 harness 和知识模板,免去从零搭建 [0]。反旋转循环内置无进展检测、重试上限、flip-flop 检测和预算,防止 Agent 原地打转或偷偷改测试让测试通过 [0]。循环工程的起点是写入循环:最广为传播的说法是 30% 的代码已由循环写完,形态是夜间定时审视 PR、把可修复的落地 [0]。云端 Routine 则把维护、审查、备份任务按 cron 封装上云 [0]。
成本:循环是钱做的
最贵的一课来自 Steinberger:一百个 Codex 实例跑一个月,烧掉 130 万美元 API 费用,对应 30 天 6030 亿 token、760 万次请求 [17,19]。素材引用的社区警告同样指向账单——Uber 曾把工程师的每工具月额度压到 1500 美元,某 Reddit 用户一条命令一晚上烧掉约 6000 美元(1273 个赞),YouTube 上流传的总结是一段代码:“while (you have tokens): Burn them in a loop!” [0]。
对策是把预算纳入循环设计:Goal 条件可以带“或 N 轮后停止”,Routine 按日额度运行,先设上限再走开 [0]。工程上,迭代上限、成本预算、时间上限都作为显式停止条件写进循环 [71],护栏组件包括最大轮数、预算上限、权限控制、无进展检测 [68]。Claude Code 自己也在加这类护栏:重复阻塞的 stop hook 连续 8 次后强制结束回合 [1]。
验证:循环里唯一难的部分
“一个分不清好坏输出的循环,只是在更快地自动犯错” [0]。这正是 /goal 使用独立评估模型的原因:不让工人给自己的作业打分 [69,4],也是最强的几个案例(Boris 的验证器、构建-测试-修复对、Clodex)都把第二双独立眼睛放进循环的原因 [0]。自我评分的 Agent 会删掉失败的测试然后宣布完成 [0]。
原因在于循环里装着一个不可靠的推理步骤,所以护栏比在普通程序里重要得多 [66]。每一步都有证据和退出条件,这比模型聪明程度更关键 [71];中文社区对这场运动的概括是“真正难的不是生成,而是验证” [60]。AI 编码 Agent 的质量往往取决于循环设计本身,底层模型只构成部分因素 [63]。
从提示工程到循环工程
这场运动的杠杆点已经上移:过去两年的优势在提示层面——更好的提示、上下文和单次输出;这个阶段正在结束,下一个杠杆是决定 Agent 做什么、何时做、用什么关卡、什么状态在运行之间存活的那个系统 [58]。循环工程将开发者角色重新定义为设计会自动提示、检查、引导 Agent 的系统,取代逐条提示 Agent 的做法 [61]。Boris 的原话是:“我不再提示 Claude 了,我跑着会提示 Claude 的循环……我的工作就是写循环” [65]。
素材对这场运动最精炼的判断是:调度层真的只是 cron,cron 从未有过的是循环体内那个读状态、行动、检查是否有效、决定是否继续的决策器——那个决策才是新东西,其余都是管道 [0]。这与设计范式把“停止”列为头等变量是同一件事:把“完成长什么样”写死,比让 Agent 更聪明更重要 [69]。
但路线图也给了诚实的刹车:大多数开发者现在还用不上循环——只有当任务重复、验证已自动化、预算能吸收浪费、Agent 握有资深工程师工具时,循环的成本才低于回报;缺少任一条件就不应使用循环,从小处开始:一个自动化、一个技能、一个状态文件、一个关卡,把一次手动运行搞可靠,再包进循环 [58]。成熟度也别一步跨到 L5(多 Agent、多队列、多验证器的组织级循环),先把 L2(有 max_steps 和测试的有限循环)做稳 [71]。
素材给出的今晚即可用的起步组合是:构建-测试-修复对配 /loop、五分钟维护者配 /loop、PR 例程配 /schedule 过夜,每一条都带预算和验证器 [0]。别再充当循环里的机器,写下 goal、loop 或 routine,给它预算和自检的方式,然后决定下一步建什么 [0]。
参考来源
- 素材原文(见文首来源链接)
- claude-code/CHANGELOG.md at main - GitHub
- Releases · anthropics/claude-code
- Claude Code Changelog on X: “Claude Code 2.1.139 has been released. 50 CLI changes, 1 system prompt change Highlights: • Added /goal command to run tasks across turns until a set completion condition, with live elapsed/turns/tokens • System prompt compaction is now silent (no trimming alert), which may https://t.co/TOGC6ufh4S” / X
- Claude Code v2.1.139 深度解读:Agent 视图 + /goal 命令的架构逻辑 - 码哥字节 - 博客园
- Claude Code Changelog: All Release Notes (2026)
- Claude Code Updates by Anthropic - August 2026
- Releases · anthropics/claude-code
- Claude Code Changelog Archive
- claude-code-release-notes | ClaudeLog
- What’s new - Claude Code Docs
- Claude Code 2.1.7 change log https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
- For $1.3 million a month, OpenClaw founder Peter Steinberger runs 100 AI agents that code, review PRs, and find bugs
- OpenClaw 創作者彼得·斯坦伯格(Peter Steinberger)談論了中國(China)如何全力投入 AI 代理與 OpenClaw。 「在中國(China),安裝 OpenClaw 被稱為『養龍蝦』。成千上萬的人在深圳的騰訊(Tencent)辦公室排隊,等著安裝他們的『龍蝦』。 深圳甚至為使用 OpenClaw 經營業務的人發放補貼。 現在,如果你在工作電腦上安裝 OpenAIClaw(在世界許多其他地區),至少在預設設定下,你可能會被解僱。 後來我在中國(China)遇到一位企業家,他向我展示了一份電子表格。每位員工,每一天,都要用 OpenClaw 自動化完成一項任務。 如果你錯過了太多天,你就會被解僱。 所以,用了被解僱,不用也被解僱。」 (來自官方「TED」YouTube 頻道)
- Who is OpenClaw creator Peter Steinberger? The millennial developer caught the attention of Sam Altman and Mark Zuckerberg
- Peter Steinberger
- Peter Steinberger’s 100 AI agents racked up $1.3 million in OpenAI tokens in 30 days building OpenClaw
- Inside OpenClaw: Peter Steinberger on Running the Fastest-Growing Open Source AI Project
- OpenClaw creator’s $1.3 million monthly OpenAI bill …
- The Rise of The Claw with OpenClaw’s Peter Steinberger
- The creator of Clawd: “I ship code I don’t read” - The Pragmatic Engineer
- Peter Steinberger 🦞 on X: ""OpenClaw is the first project to break both those records while being actual software that people install and run."" / X
- Medium
- 使用星标保存仓库 - GitHub 文档
- Github开源项目:每周📈飙升榜top20,每周一早上8点更新
- GitHub 开源了一个 11 万 Star 工具,让 AI 写代码不再是猜谜游戏-腾讯云开发者社区-腾讯云
- 【开源】Github上的一个Star值多少钱 | 开源项目为何要刷星 | 如何给Github项目刷量 | 真假用户行为 | 非监督聚类检测算法
- GitHub - kenn-io/roborev: Continuous background code review …
- roborev/CLAUDE.md at main · kenn-io/roborev · GitHub
- Trending repositories on GitHub today
- GitHub - Dicklesworthstone/most-influential-github-repo-stars: See the most influential users who have starred or forked a given repo (sorted by earned stars and follower count) · GitHub
- GitHub Integration - roborev
- How to get more GitHub Repo STARS (Open Source)
- Picking Your Catalog: The Contenders, the Bet, and the Road Ahead | Nidhi Vichare
- Databricks Iceberg Support Has a Catch. It’s Called Unity Catalog.
- Music Catalog Explained: What It Is, What Selling Means, and How It Works | Royalty Exchange
- Unity Catalog | Databricks
- What is a Catalog and Why Do You Need One? | MinIO
- The Rising Value of Song Catalogs: Queen Songs Set Record – MusicGoldmine.com
- 2. NGC Catalog User Guide — NVIDIA GPU Cloud Documentation
- Amazon Product Targeting Strategy 2026: Defend Your Detail Pages, Raid Your Competitors’
- DP raid title - collections : r/DestinyTheGame - Reddit
- Megarare Rewards for Raids 4 (OSRS)
- Raiders, why do you raid? None riders … - FINAL FANTASY XIV Forum
- Anthropic
- peter steinberger openclaw: Latest News & Videos, Photos about peter steinberger openclaw | The Economic Times - Page 1
- 3/ Two of the most powerful features in Claude Code: /loop and /schedule Use these to schedule Claude to run on an interval, for up to a week at a time. I have a bunch of loops running locally: - /loop 5m /babysit, to auto-address code review and auto-rebase my PRs - /loop 30m /slack-feedback, to automatically put up PRs for Slack feedback every 30 mins - lots more!.. Experiment with turning workflows into skills + loops. It’s powerful. https://code.claude.com/docs/en/scheduled-tasks
- 宝玉 on X: “OpenClaw 创始人 Peter Steinberger 加入 OpenAI Sam Altman 刚宣布,开源 AI 智能体项目 OpenClaw 的创始人 Peter Steinberger 正式加入 OpenAI,将负责推动下一代个人智能体的开发。 Peter Steinberger 是一位奥地利开发者,此前曾创办 iOS 开发工具公司 PSPDFKit” / X
- 哪些平台发布视频有播放量就有钱
- WTF Is a Loop? Part 2: The 15 Loops People Are Actually …
- WTF Is a Loop? Part 2: The 15 Loops People Are Actually … - VIBE
- Monica Plath (@MonicaMPlath) / Posts and Replies …
- Matthew Berman on X: “WTF is a loop part 2. Shout out …
- Clawdbot founder Peter Steinberger just revealed the exact …
- Make viral Ai epoxy Timelapse videos with this Claude …
- 老黄发声:Prompt已死,AI圈疯追Loop!
- 你还在手写 Prompt?聪明的人早就用上了循环工程,AI 的自动驾驶时代来了_腾讯新闻
- Loop Engineering:从提示者到循环设计者的14步路线图-腾讯云开发者社区-腾讯云
- Agent Loop: 多智能体协同,让AI长时工作,从原理到实践_哔哩哔哩_bilibili
- 图解Loop Engineering循环工程从 Prompt 到 Harness,为什么 AI Agent 开始自己跑循环?
- What Is Loop Engineering? | IBM
- Loop Engineering: How to Build AI Agent Loops That Run Themselves
- What Is Loop Engineering? The New Meta for AI Coding …
- Medium
- Loop Engineering - AddyOsmani.com
- Can anyone explain me “loop engineering” like I’m 5? It just keeps making no sense to me. : r/AI_Agents
- 【第一部分:认识 Agentic AI】4. 智能体的工作循环——从 ReAct 到 Plan-Execute-腾讯云开发者社区-腾讯云
- 从 Prompt 到 Agent Loop:让 AI Agent 稳定工作的循环设计方法 - 全栈研发笔记
- meng shao on X: “Claude Code 官方分享「Loops」设计范式 把”Agent 工程”从经验直觉提升为可复用的设计语言:触发、停止、工件、适用场景——四个变量一旦确定,循环的形态就确定了。 # 核心升级:从”提示”到”循环”的范式转换 · 传统用法中,人主导每一轮(turn):发提示 → agent 执行 → 人检查 → https://t.co/6Ybhkdmvag” / X
- 別再 prompt AI?搞懂爆紅的 agent loop,再決定要不要學
- Loop Engineering,给 AI Agent 设计可验证的自我迭代循环 | Misaka’s blog
- 深入 Open Agent SDK(一):Agent Loop 内核——从 prompt 到多轮对话的完整运转机制 - 四眼蒙面侠 - 博客园