4 位工程师刚刚告诉你:别再只写 prompt 了。那应该做什么?

7 天内,四位顶尖 AI 工程师说了同一件事。本文会拆解他们到底是什么意思,并给你一套今天就能开始用、无需写代码的系统。

6 月 7 日,一位名叫 Peter Steinberger 的开发者在 X 上发了两句话。

「每月提醒一次:你不该再给 coding agent 写 prompt 了。你应该设计那些会替你 prompt agent 的 loop。」

800 万人读到了它。

然后,Anthropic 的 Claude Code 负责人从内部确认了这一点:

「我现在已经不 prompt Claude 了。我有一些 loop 在跑,它们会去 prompt Claude。我的工作是写 loop。」

随后,Google Cloud AI 总监 Addy Osmani 写了 1,300 字来拆解这件事。24 小时内 130 万浏览。

而在这一切发生前四天,Anthropic 的一位工程师已经发布了让这一切成为可能的功能。

四个不同的人。一个信号。

你现在和 Claude 协作的方式,已经过时了。


免费礼物承诺……

读到本期末尾,你会拿到一份可复制粘贴的 Claude Loop Starter Kit:5 个 prompt,用来搭建你的第一个个人 Claude 系统,无需写任何代码。


老实说。

当我第一次看到那条两句话的帖子冲到 800 万浏览时,我的反应是:「这是给工程师看的。不是给我的。」

然后我坐下来想了两个小时。

接着我做了一个很小的东西:一个 Claude Project,它知道我的 newsletter 上下文,会跑我每周的内容研究,并在我打开空白页之前,把初稿交到我手里。

我以前把 Claude 当自动售货机一样 prompt。

放点东西进去,拿点东西出来,重复。

而那些构建 Claude 的人,是把它当工厂车间来运行。机器在运转,你负责监督。

这个视角转换,改变了我这一周的工作方式。

这件事不是从一条 tweet 开始的,而是从 Anthropic 发布了一个东西开始的。

https://x.com/i/status/2061907337154367865

6 月 3 日: Anthropic 技术团队成员、Claude Code 团队的 Thariq Shihipar 发布 Dynamic Workflows 功能。290 万浏览。这条帖子一开头就给了这样的示例 prompt:

「用一个 workflow 翻查过去六个月 Slack 里的 #incidents,找出反复出现但没人提交 ticket 的根因。」

这不是 coding 任务,而是思考任务。它已经被自动化了。

https://x.com/i/status/2063697162748260627

6 月 7 日: Peter Steinberger 发出那两句如今已经很出名的话。

他说这是「每月提醒」,意思是他已经说这事说了一阵子了,但人们还是没听进去。800 万浏览,1.4 万收藏。

6 月 9 日: Anthropic 的 Claude Code 负责人 Boris Cherny 从内部确认:

「我现在已经不 prompt Claude 了。我有一些 loop 在跑,它们会 prompt Claude,并判断下一步该做什么。我的工作是写 loop。」

同一天,Addy Osmani 发布了那篇 1,300 字的拆解。130 万浏览。

四个来源。七天。一个共识:杠杆点已经变了。

https://x.com/i/status/2064127981161959567

「一周之内,AI 世界顶层的四个人说了同一件事。这不是趋势。这是信号。」


如果这篇对你有用,把它分享给一个每天早上还在复制粘贴 prompt 的人。只要 10 秒。


为什么单独 Prompt 会崩掉

在讲修法之前,我们得先理解,为什么只靠 prompt,在规模一大时就会失败。

当你依赖单个 Claude 会话来做复杂工作时,会出现三种失败模式。一旦你看见了,就很难再假装没看见。

失败模式 1:Agentic Laziness(Agent 式偷懒)

Claude 还没做完就停下,然后宣布任务完成。你让它做 50 项安全审查。它做了 20 项,然后告诉你已经完成了。你没发现。

失败模式 2:Self-Preferential Bias(自我偏袒偏差)

Claude 给自己的作业打分。你让它验证自己的输出。它同意了自己。它当然会同意自己。

失败模式 3:Goal Drift(目标漂移)

在一个很长的会话里,原始目标会悄悄偏移。边界情况被丢掉。「绝不要做 X」这类约束,在几轮总结之后消失了。Claude 还在工作,只是不是在做你最初要求的那件事。

这些不是 bug。

它们是单个 context window 的结构性限制:同一个窗口同时试图规划和执行。

loop 的修法,是给每个任务一个自己的 Claude、自己的 context window,以及一个单一聚焦的目标。

做东西的人不该给自己的作品打分。第二个 Claude 来做这件事。


旧方式 → 新方式对照

旧方式:

你打开 Claude。你想自己需要什么。你写一个 prompt。你读输出。你复制一些东西。你关掉标签页。明天,你从头再来一遍。Claude 不记得你的项目、你的目标,也不记得你的声音。

旧工作流:

Open → Think → Type → Read → Copy → Close → Forget → Repeat.

每个会话都是冷启动。你就是系统。你也是瓶颈。

新方式:

一个系统持有你的上下文,在正确的时间触发正确的 prompt,然后把输出交给你。一个 Claude 做工作。第二个 Claude 检查它。你只审查通过检查的内容。

新工作流:

Build once → System prompts → Claude works → Second Claude verifies → You review.

你从「写 prompt 的人」,变成了「设计什么会被 prompt、并检查结果的人」。


Loop 到底是什么(无代码版)

这里有很多难懂的词,比如 worktree、JavaScript 文件、sub-agent spawning。现在先全都忽略。

用大白话说,loop 是这个东西:

一组会自动运行、完成有用工作,并把结果交给你的指令。

就是这样。

对工程师来说,它是代码。对你我这种每天用 Claude、但一行 JavaScript 都不写的人来说,loop 是一个 Claude Project:它知道你的上下文,运行你的重复任务,并用第二遍来检查自己的工作。

可以这样理解:

你不会每次做饭都重新建一个厨房。

你只建一次。然后在里面做饭。

Claude loop 就是你的厨房。


6 种 Loop 模式(翻译给非工程师)

模式 1:Fan-Out and Synthesize(扇出再综合)

把一个大任务拆成更小的部分。让 Claude 分别处理每个部分。再把结果合起来。

给你的真实例子: 让 Claude 分别研究 5 个不同的内容角度,然后综合出最好的那个。不要让它在一个 prompt 里一次性做完 5 个;质量会下降。

模式 2:Adversarial Verification(对抗式验证)

Claude 产出某个东西后,用第二个 prompt 从反方向审查它:找缺陷,而不是认可它。

给你的真实例子: Claude 写完 newsletter 初稿后,跑这个:「你是一位怀疑主义编辑。找出这份草稿里每一个薄弱论断、含糊句子和错过的机会。」 不同角色,会带来不同输出。

模式 3:Tournament(锦标赛)

生成某个东西的多个版本。让 Claude 按 rubric(评分标准)评判它们。选出赢家。

给你的真实例子: 让 Claude 为你的下一篇帖子写 5 个 hook。然后问:「按这几个标准评判这 5 个 hook:好奇心缺口、身份信号、分享潜力。给它们排 1–5 名,每个用一句话说明理由。」

模式 4:Loop Until Done(循环直到完成)

不要设置固定尝试次数,而是一直做,直到满足一个真实条件。

给你的真实例子: 「持续改进这份草稿,直到没有任何废话句,而且每个论断都有具体数字或例子支撑。条件满足之前不要停。」

模式 5:Generate and Filter(生成再过滤)

先批量产生大量想法。再按 rubric 严格过滤。只保留最好的。

给你的真实例子: 「生成 20 个 newsletter 标题选项。然后过滤:只保留使用指责、欲望或范式转移框架的标题。其余全部删除。」

模式 6:Deep Verification(深度验证)

让一个 Claude 识别内容中的所有论断。再让第二个 Claude 逐一验证。

给你的真实例子: 「读这份草稿。列出我提出的每一个事实性论断。然后逐一验证,标出任何含糊、缺少依据或可能错误的地方。」


在你开始用这些 prompt 之前,先停一下。

我知道你在想什么。「这是给工程师的。我又不会搭 worktree,也不会 spawn sub-agent。」

你说得对,你不会做那些。但你每周确实在做的是:重新打开 Claude,输入和上周差不多的 prompt,得到差不多的输出,然后继续往前走。没有记忆。没有改进。没有系统。

你的版本不需要 JavaScript。它需要一个 Claude Project、一个 memory file,以及三个带审查步骤的重复 prompt。这就是 loop。作为起点,这就够了。

这周就把它搭起来。其他东西会从这里开始复利增长。


分步指南:搭建你的第一个 Claude Loop

第 1 步:构建你的 Memory File

这是你的 loop 的大脑。它告诉 Claude 你是谁,这样每次会话一开始就是带着信息进入,而不是冷启动。

快速设置:

  1. 打开 Claude → Projects → Create new project
  2. 在 Project Instructions 里粘贴你的上下文:你的名字、你创作什么、你的受众、你的语气,以及你的重复目标
  3. 加上这一行:「每次我打开这个 project 时,先确认你理解我的上下文。然后问:今天我们要做什么?」

「正是这一个文件,把 loop 和一次性 prompt 区分开来;loop 会记得,prompt 会忘记。

第 2 步:写你的 Trigger Prompt/Skill

trigger 会启动每次会话。它会在你打出第一个字之前激活你的 loop。

快速设置:

  1. 写一个 master prompt,开头是:「你是我的 [content/research/work] assistant。每次会话都从审阅 [X] 并产出 [Y] 开始。」
  2. 把它固定保存在 Project Instructions 里
  3. 测试它:关闭 project,重新打开,看 Claude 第一件事会做什么

「trigger 是你教 Claude 对自己说的『早上好』,这样你永远不用从零开始。」

第 3 步:加入 Adversarial Verification

这是大多数人会跳过的一步。它也是最重要的一步。

当你的 loop 产出内容之后,运行第二个 prompt,让它从反方向检查。

快速设置:

  1. 任何重要输出之后,粘贴这段:「你是一位怀疑主义编辑。你的工作不是认可这份内容。你的工作是找出每一个薄弱论断、含糊句子和错过的机会。」
  2. 使用和第一个 prompt 不同的角色框架,迫使它换一个视角
  3. 合并两轮输出:只保留经受住两遍检查的内容

「maker Claude 和 checker Claude 不应该在同一个 prompt 里。一个写。一个攻击。」

第 4 步:建立你的 Prompt Library

你最常重复的三到五个任务,会变成保存下来的 prompt。

这是你的 loop 的引擎。

快速设置:

  1. 列出你最常用 Claude 做的任务(内容研究、写草稿、周回顾、回复邮件、生成想法)
  2. 为每个任务写一个优化过的 prompt,或更新你的 skill;里面要放真实上下文,不要用占位符
  3. 把它们保存在一个 Notion 页面或 Claude Project 文档里,标为「Loop Prompts」

注意:把表现最好的输出用作你的 project 或 skill 的参考/上下文文件。

第 5 步:每周跑一次 Loop Review

loop 每周都会变聪明,但前提是你花 10 分钟复盘它。

快速设置:

  1. 每周日,打开 Claude 并粘贴:「回顾本周我们一起做过的工作。哪些产出了强结果?哪些很弱?根据你观察到的情况,建议一条对我的 Project Instructions 的更新。」
  2. 应用它建议的更新
  3. 删除任何本周没有帮你节省时间的 loop prompt

「跳过这一步,loop 就会停滞。做了这一步,loop 就会复利增长。每周十分钟。」


免费礼物交付

你承诺中的免费礼物来了:

下面 5 个 prompt,就是你的 Claude Loop Starter Kit。今天就把它们复制到一个 Claude Project 里。把方括号中的上下文替换成你自己的工作。你的 loop 这周就能开始运行。

从 Memory Installer 开始。然后加上 Adversarial Editor。光这两个,就会在周末之前改变你的输出质量。

Tournament Hook Generator 是你每周的秘密武器。每次你需要一个开头、但想不出来时,就跑它。

Prompt 1 - The Memory Installer

把这段粘贴到 Project Instructions。它是你的 loop 的大脑。

You are my personal AI assistant. Here's what you always know about me:

Name: Hamza
What I do: I write the AI In Public newsletter on Substack. I create Claude guides,
tutorials, and AI workflow systems for ambitious builders and career-changers.
My goals right now: Grow newsletter to 10K subscribers. Build a content system that
runs with less manual effort each week.
My tone when writing: Direct. Honest. Practical. Never hype. No fluff.
Things I never do: Generic advice without a specific example. Vague prompts with
placeholder text. Long intros before the value.

Every time I open this project, start by confirming you understand my context.
Then ask: "What are we working on today?"

「最后两行就是 loop trigger;它们让 Claude 从第一秒开始就主动起来,而不是被动等待。」

Prompt 2 — The Adversarial Editor

任何初稿之后都运行它。这是整个套件里最重要的 prompt。

You are a skeptical editor reviewing a draft for AI In Public newsletter.

Your job is NOT to validate this draft. Your job is to find problems.

For every section, tell me:
1. What claim is weakest or most vague?
2. What sentence could be cut without losing value?
3. What's missing that a skeptical reader would ask for?

Do not soften your feedback. Be specific. Diagnose, don't summarize.

Here is the draft: [paste draft]

「『Diagnose, don't summarize』这一个短语,会迫使 Claude 从啦啦队模式切到编辑模式。」

Prompt 3 — The Tournament Hook Generator

当你需要为任何帖子、thread 或 newsletter 写 hook 时,运行它。

Write 5 different hooks for this content. Each hook must use a different format:
1. Accusation hook ("You're doing X wrong")
2. Paradigm shift hook ("The way X works just changed")
3. Personal proof hook ("I tested X for 30 days. Here's what happened")
4. Desire hook ("Imagine being able to X in under Y minutes")
5. Shock hook ("X% of people using Claude don't know this exists")

Topic: [your topic]
Audience: Ambitious builders and content creators who use Claude daily

After writing all 5, judge them on: curiosity gap, identity signal, share potential.
Rank 1–5. Explain the top pick in one sentence.

「最后的排名步骤,会把它从想法清单变成一次决策,不要跳过。」

Prompt 4 — The Loop Until Done Refiner

当一份草稿已经接近完成、但还差一点时,用它。

You are a ruthless editor with one job: eliminate all filler.

Read this draft. Keep going until every single sentence meets ALL three criteria:
1. Contains a specific number, example, or named source — OR
2. Moves the reader to the next idea — OR
3. Creates a genuine emotional reaction

If a sentence fails all three tests, cut it. No exceptions.

Do not stop until the condition is true for every line.

Here is the draft: [paste draft]

「『Do not stop until the condition is true for every line.』这就是 loop trigger。它会迫使 Claude 做多轮检查。」

Prompt 5 — The Sunday Loop Review

每周日运行。它会自动更新你的系统。

Review our work together this week in this project.

For each major task:
1. What produced strong, usable output?
2. What was weak, vague, or required heavy editing?
3. What was the root cause — a bad prompt, missing context, or wrong framing?

Based on this review, suggest ONE specific update to my Project Instructions
that would improve next week's output.

Write the update as a ready-to-paste instruction, not a suggestion.
Be specific. If you can't point to a concrete improvement, say so.

「『Write the update as a ready-to-paste instruction』会把 loop 闭上。你把它粘进去,系统就会进化。」


彻底诚实一点

关于这类 hype 帖,有件事没人说。

一个无人看管的 loop,也是在无人看管地犯错。

loop 很强,但它有成本:token 成本、理解成本,以及当你不再阅读它产出的东西时的信任成本。系统跑得越快,你就越容易停止理解它到底在构建什么。

你构建了 loop,并不意味着你的工作消失了。消失的是重复部分。判断部分仍然属于你。

构建 loop。继续当编辑。


回顾清单

60 秒版:

  1. 7 天内四位工程师确认了同一件事:杠杆点已经从 prompt 转向构建系统
  2. 单独 prompt 会因为 agentic laziness、自我偏袒偏差和目标漂移而失败
  3. 一个 loop = Memory File + Trigger Prompt + Adversarial Check + Prompt Library + Weekly Review
  4. 六种 loop 模式不用写代码也能用:Fan-Out、Adversarial Verify、Tournament、Loop Until Done、Generate + Filter、Deep Verify
  5. 这周先从 Prompt 1(Memory Installer)开始,其他东西都会从那里生长出来

保存这篇。截图这篇。回头再看。


我们已经公开测试过了。现在去私下用起来。

PS:这 6 种 loop 模式里,哪一种最适合你现在的工作?

回复告诉我——我想知道你会从哪一种开始。

  • Hamza 💙