← 回成果库

FlowText → 真 Agents 协同:设计与实测验证

日期:2026-07-22 | 项目:M-281 / P332 | 作者:数字分身(Claude Code 主会话)

一句话结论

能做到。 在你现在用的手机 Claude Code 里,画板导出的 FlowText 可以由【真正互相独立的多个 agent】协同执行(每步独立上下文、真并行、真循环、执行者≠验证者、文件交接),不再是"一段提示词发给一个 AI 演戏"。本次已交付两件配套工具并用 3 个真 agent 实测验证。

二、你问的四个问题,逐个回答

1)"一次发给一个 AI 容易变成表演,上下文有限"——判断正确吗?

正确,而且这就是两者的本质分界:

普通版说明书(发任意 AI)Agents 协同版(发 Claude Code)
步骤执行者同一个上下文"扮演"所有步骤每步新起一个真独立 agent(全新上下文)
红队/验收自己审自己(高概率演戏)验证者是另一个 agent,不知道执行者想证明什么
并联只是文字顺序,假并行同一批真的同时跑
循环"请循环5轮"靠自觉,常偷懒合并编排层逐轮真派发,判停由裁判 agent 裁决
上下文上限全流程挤一个窗口,长流程必丢步骤间用文件交接,步骤数不受窗口限制

2)"要不要 agents 协同专用版?" — 要,已做

3)"步骤之间是不是要 harness/系统层面强制?" — 是,且现成

Claude Code 本身就是那个 harness:

不需要再引入 openclaw 之类的外部框架——那类系统解决的问题(强制步骤边界、状态持久、验证独立)在这里分别由 Agent 工具、文件交接、独立验收 agent 覆盖。

4)"只在手机,能做到吗?" — 能,零差别

手机 Claude Code 只是遥控窗口,所有 agent 跑在云端容器里;粘贴 Agents 版文字 → 开跑 → 可锁屏 → 回来看运行卡。本报告的实测演示就是在这个手机会话里完成的。

三、实测凭据(E1·本会话真跑)

迷你工作流「一句话讲清复利」:S1a/S1b 并联(两个独立 agent 各写一版)→ S2 独立验收(第三个 agent 评分裁决)。

四、诚实边界(红队自审)

1. 最强反对:"这演示太小,大工作流会不会崩?" — 回应:文件交接使上下文与步骤数解耦,这正是为大流程设计的;但 50+ 步/深嵌套循环的 token 成本会显著上升,所以 flowrun 规定 M>15 次派发先报价。真正的压力测试(跑一个 MEGA 案例)还没做,这是当前最大缺口。

2. 普通聊天 AI(非 Claude Code/无子agent能力)拿到 Agents 版也只能退化为普通说明书执行——协同版只对"有 agent 能力的 harness"生效,这点已写进契约头。

3. 子 agent 与主会话同模型,能消灭"自审放水",消不了范式级共享盲点(那层仍靠外部异构审计,Rule-EXTREVIEW-001)。

五、下一步(按推荐度)

1. 用一个 MEGA 巨型案例真跑一次全量压力测试(循环+并联+验收全上)。

2. 把 🤖 Agents版导出推广到其余三个画板。

3. 案例库每个案例加"发 Claude Code 用 Agents 版"一键复制。