- 案例库 https://metazero-terminal.pages.dev/batch/case-library.html → 分类 🧭 文章辩证解读(现 5 例,总库 143→145,v3.3)
- DM-04 问题优先·辩证研究(12 步) / DM-05 辩证快答(6 步)
- 协议升 v1.1,新增 §16 问题优先模式:MetaZero-OS/01-Protocol/DIALECTIC-MAP-文章辩证解读与逻辑审计协议-v1.md
- 对话口令:辩证研究 <问题> / dr <问题> / 辩证快答 <问题>
| 审文章(模式 A) | 从问题出发(模式 B) | |
|---|---|---|
| 承重论断是谁的 | 别人的 | 我自己生的 |
| 我的位置 | 审计者,天然带怀疑 | 生产者兼审计者 |
| 真正的敌人 | 别人的文笔与选择性取材 | 我自己的确认偏误 |
位置一变,产生三种自欺,模式 A 一条都防不住。所以 §16 焊了三道防线:
| 自欺 | 长什么样 | 硬补丁 |
|---|---|---|
| 单假设隧道 | 想到第一个答案就一路找支持 | 先立 3-5 个互斥竞争假设(含≥1 个"我不愿相信的");顺序铁律:先立假设,后采证——倒过来做,你只会想出证据已经支持的那一个 |
| 确认偏误采证 | 只搜支持我的,搜到就停 | 对称采证:每个假设同时采 ≥2 条最强支持 + ≥2 条最强否证 + 一条"显著缺席的证据";只有支持没否证 = 退回重搜 |
| 自审自签 | 自己当自己红队,挑无关痛痒的刺 | 红队必须是不知道我想证明什么的独立 agent(执行者≠验证者);自审自签是本模式第一死因 |
一句话:模式 A 的难点是"看穿别人",模式 B 的难点是"防住自己"。
| 步 | 干什么 | 硬验收(不过就退回) |
|---|---|---|
| S1 | 问题 + 你要拿答案做什么决定 + 何时必须有答案 | 说不出"要做什么决定"= 题没想清,先补 |
| S2 | 锁 crux + 定 10 分/0 分答案标尺 | 过反事实标尺:答案不同却不改变任何行动 = 务虚,换题 |
| S3 | 拆 3-6 个 MECE 子问题 + 预标哪块地基软(只能得【I】推论) | 结论强度不许超过最软的那块地基 |
| S4 | 立 3-5 个互斥竞争假设 + 写下我的直觉答案当靶子 | 全是同一答案的变体 = 没真发散,重列 |
| S5 | 🔁 逐假设对称采证(联网) | 只有支持没否证 = 退回重搜;核不到写"未获取" |
| S6 | 🔁 逐假设辩证卡 + 12 维评分 + 置信度算式 + 三元组 | 禁止只写高/中/低;≥85 必须配得上高质量证据 |
| S7 | 不一致计数淘汰(证据×假设矩阵) | 绝不按支持数最多选;前两名 I 计数差≤1 → 如实判"未决"并写清缺哪条证据 |
| S8 | 反直觉定量校验(压成比率/费米估算) | 算式可复算;数字与定性结论矛盾处优先深挖,不许掩盖 |
| S9 | 归因收敛 2-4 条机制 | 每条须反解释 ≥3 个子问题 + 一个可检验推论;压不出机制 = 这次只是查了资料 |
| S10 | 独立红队审我 | 执行者≠验证者;与我自评显著背离 = 同源盲点实锤,回 S5 补证 |
| S11 | 决策卡 | 必须写出"为什么不是别的答案"(含被淘汰假设各被几条否证);写不出可执行动作 = 降级"只够理解" |
| S12 | 观察清单 + 预测登记 + 12 项质量闸 | 每个前瞻指标写清"看到什么算我说对/说错"+中途校验点 |
DM-05 快答 6 步:锁 crux 并先写下直觉答案 → 立 3 个互斥假设(含 1 反直觉)→ 对称快核(各 1 支持 1 否证)→ 不一致计数 + 置信度 → 决策卡。
这一档最有价值的时刻 = 我的直觉答案被淘汰,必须显式写出来。
| 环节 | 复用现成引擎 | 本协议独有的加法 |
|---|---|---|
| S2 锁 crux + 反事实标尺 | Isaac 首席提问官 / CLARITY-7 第 1 步 | — |
| S4/S7 竞争假设 + 不一致计数 | a129-ach(Heuer 八步) | — |
| S5 采证 E1/GIGO | CLARITY-7 第 3 步 / Rule-GIGO-001 | 对称采证 + 显著缺席证据 |
| S6 逐条评分 | — | ⭐ 12 维加权 + 置信度算式 + 6 项惩罚 + 三元组 |
| S9 归因收敛 | CLARITY-7 第 4 步"压成核" | ⭐ 硬判据:每机制反解释 ≥3 子问题 + 可检验推论 |
| S10 独立红队 | Verity / Rule-EVIDENCE-001 | — |
| S11 决策卡 | probflow 决策卡模板 | ⭐ 被淘汰假设与其否证条数一并摆出 |
| S12 预测登记 | Pythia / 校准账本 | — |
明确不替代 CLARITY-7:CLARITY-7 管"怎么一步步想透并出件";DM-04 管"多个答案公平厮杀 + 置信度可追溯 + 写清为什么不是别的答案"。要标准分析出件走 CLARITY-7,要"排除式结论"走 DM-04。
| # | 检查 | 结果 |
|---|---|---|
| 1 | 格式A 解析仿真(1:1 复刻画板解析器正则) | ✅ 5/5 全通、无坏引用(步数 11/5/9/12/6) |
| 2 | 线上 cases.json 实测 | ✅ v3.3、总数 145、DM-01~05 全在位 |
| 3 | 真浏览器端到端(Playwright 实点) | ✅ chip「🧭 文章辩证解读 5」、5 卡 5 个「在画板打开」 |
| 4 | 画板真建图 | ✅ DM-04 = 12 节点(DOM 12)/17 连线/1 循环(成员 2);DM-05 = 6/5/0;DM-01~03 仍 11/5/9 全对;无 JS 错误 |
| 5 | 截图真看 | ✅ DM-04 toast「已生成:12节点/17连线/1个循环」,循环虚线框包住 S5 对称采证+S6 辩证卡,联网硬要求徽标在 S5/S8 上 |
| 6 | 部署 | ✅ Cloudflare Pages 已上线(本次部署 ID 81aa9e8d) |
诚实边界:第 3/4 项跑在本地服务(浏览器直连线上被代理 TLS 重置),用的是与线上完全同一份 sandbox-board.html + cases.json;线上侧由第 2 项 curl 独立核实。未在主席真手机上实点。
1. 最强反对:「你又交了一个工作流,还是没有一次真跑的样例。上一轮已经是'工具没样例',这轮重犯。」
回应:成立,这是本次最大缺口。没自跑是因为 DM-04 的产出质量 100% 取决于问题选得对不对,而问题该由主席定(选错题 = 12 步全白跑,且会污染案例 note 里的"自跑样例"链接)。已把"用 DM-04 真跑一个主席指定问题"列为第 1 号下一步。在有真跑样例之前,DM-04 只能算"设计完成",不算"验证有效"。
2. S10 的独立性有天花板:独立 agent 与我同模型,能抓证据真伪/不对称标准/逻辑漏洞,抓不了范式级共享盲点。真要那一层必须升外部异构(Codex/真人,走 external_review_queue)——协议已写明,但本次没跑。
3. 纪律不是机器闸:S5"只有支持没否证就退回"、S7"绝不按支持数选"目前靠执行者自觉。可加一道脚本闸(检查产出是否含矩阵、是否含否证栏、置信度是否带算式),本次未做。
4. 可能的过度工程:12 步对"该不该买杯咖啡"级问题是杀鸡用牛刀。缓解:DM-05 快答档 6 步,且 skill 第 0 步强制先判入口与轻重档。
可证伪锚:主席指定一个问题,我用 DM-04 真跑一遍;若产出的决策卡里写不出"为什么不是别的答案"(被淘汰假设+各自否证条数),或置信度给不出算式,则本工作流设计不合格,回炉。