日期:2026-07-22 | 项目:M-281 / P332 | 作者:数字分身(Claude Code 主会话)
能做到。 在你现在用的手机 Claude Code 里,画板导出的 FlowText 可以由【真正互相独立的多个 agent】协同执行(每步独立上下文、真并行、真循环、执行者≠验证者、文件交接),不再是"一段提示词发给一个 AI 演戏"。本次已交付两件配套工具并用 3 个真 agent 实测验证。
正确,而且这就是两者的本质分界:
| 普通版说明书(发任意 AI) | Agents 协同版(发 Claude Code) | |
|---|---|---|
| 步骤执行者 | 同一个上下文"扮演"所有步骤 | 每步新起一个真独立 agent(全新上下文) |
| 红队/验收 | 自己审自己(高概率演戏) | 验证者是另一个 agent,不知道执行者想证明什么 |
| 并联 | 只是文字顺序,假并行 | 同一批真的同时跑 |
| 循环 | "请循环5轮"靠自觉,常偷懒合并 | 编排层逐轮真派发,判停由裁判 agent 裁决 |
| 上下文上限 | 全流程挤一个窗口,长流程必丢 | 步骤间用文件交接,步骤数不受窗口限制 |
a129-flowrun(已装进仓库 .claude/skills/a129-flowrun/):Claude Code 收到 FlowText 后按固定流程执行——解析步骤/依赖/循环 → 建运行档+运行卡 → 拓扑排序派发真 agent → 循环真迭代 → 独立验收 → 拼装终稿。你说一句「flowrun <粘贴FlowText>」即可开跑。Claude Code 本身就是那个 harness:
不需要再引入 openclaw 之类的外部框架——那类系统解决的问题(强制步骤边界、状态持久、验证独立)在这里分别由 Agent 工具、文件交接、独立验收 agent 覆盖。
手机 Claude Code 只是遥控窗口,所有 agent 跑在云端容器里;粘贴 Agents 版文字 → 开跑 → 可锁屏 → 回来看运行卡。本报告的实测演示就是在这个手机会话里完成的。
迷你工作流「一句话讲清复利」:S1a/S1b 并联(两个独立 agent 各写一版)→ S2 独立验收(第三个 agent 评分裁决)。
scratchpad/flowrun-demo/S1a.md(滚雪球版,33字)scratchpad/flowrun-demo/S1b.md(养鸡版,38字)scratchpad/flowrun-demo/S2-验收.md — 胜者 S1a,28 vs 27 分,理由与逐项分俱在1. 最强反对:"这演示太小,大工作流会不会崩?" — 回应:文件交接使上下文与步骤数解耦,这正是为大流程设计的;但 50+ 步/深嵌套循环的 token 成本会显著上升,所以 flowrun 规定 M>15 次派发先报价。真正的压力测试(跑一个 MEGA 案例)还没做,这是当前最大缺口。
2. 普通聊天 AI(非 Claude Code/无子agent能力)拿到 Agents 版也只能退化为普通说明书执行——协同版只对"有 agent 能力的 harness"生效,这点已写进契约头。
3. 子 agent 与主会话同模型,能消灭"自审放水",消不了范式级共享盲点(那层仍靠外部异构审计,Rule-EXTREVIEW-001)。
1. 用一个 MEGA 巨型案例真跑一次全量压力测试(循环+并联+验收全上)。
2. 把 🤖 Agents版导出推广到其余三个画板。
3. 案例库每个案例加"发 Claude Code 用 Agents 版"一键复制。