← 回成果库

问题优先模式:从一个问题出发做辩证研究(DIALECTIC-MAP v1.1 §16 · DM-04/05)

- 案例库 https://metazero-terminal.pages.dev/batch/case-library.html → 分类 🧭 文章辩证解读(现 5 例,总库 143→145,v3.3)

- DM-04 问题优先·辩证研究(12 步)DM-05 辩证快答(6 步)

- 协议升 v1.1,新增 §16 问题优先模式MetaZero-OS/01-Protocol/DIALECTIC-MAP-文章辩证解读与逻辑审计协议-v1.md

- 对话口令:辩证研究 <问题>dr <问题>辩证快答 <问题>


一、核心认知:为什么不能把「审文章」那套直接套到「从问题出发」

审文章(模式 A)从问题出发(模式 B)
承重论断是谁的别人的我自己生的
我的位置审计者,天然带怀疑生产者兼审计者
真正的敌人别人的文笔与选择性取材我自己的确认偏误

位置一变,产生三种自欺,模式 A 一条都防不住。所以 §16 焊了三道防线:

自欺长什么样硬补丁
单假设隧道想到第一个答案就一路找支持先立 3-5 个互斥竞争假设(含≥1 个"我不愿相信的");顺序铁律:先立假设,后采证——倒过来做,你只会想出证据已经支持的那一个
确认偏误采证只搜支持我的,搜到就停对称采证:每个假设同时采 ≥2 条最强支持 + ≥2 条最强否证 + 一条"显著缺席的证据";只有支持没否证 = 退回重搜
自审自签自己当自己红队,挑无关痛痒的刺红队必须是不知道我想证明什么的独立 agent(执行者≠验证者);自审自签是本模式第一死因

一句话:模式 A 的难点是"看穿别人",模式 B 的难点是"防住自己"。


二、DM-04 十二步(每步都带硬验收)

干什么硬验收(不过就退回)
S1问题 + 你要拿答案做什么决定 + 何时必须有答案说不出"要做什么决定"= 题没想清,先补
S2锁 crux + 定 10 分/0 分答案标尺反事实标尺:答案不同却不改变任何行动 = 务虚,换题
S3拆 3-6 个 MECE 子问题 + 预标哪块地基软(只能得【I】推论)结论强度不许超过最软的那块地基
S4立 3-5 个互斥竞争假设 + 写下我的直觉答案当靶子全是同一答案的变体 = 没真发散,重列
S5🔁 逐假设对称采证(联网)只有支持没否证 = 退回重搜;核不到写"未获取"
S6🔁 逐假设辩证卡 + 12 维评分 + 置信度算式 + 三元组禁止只写高/中/低;≥85 必须配得上高质量证据
S7不一致计数淘汰(证据×假设矩阵)绝不按支持数最多选;前两名 I 计数差≤1 → 如实判"未决"并写清缺哪条证据
S8反直觉定量校验(压成比率/费米估算)算式可复算;数字与定性结论矛盾处优先深挖,不许掩盖
S9归因收敛 2-4 条机制每条须反解释 ≥3 个子问题 + 一个可检验推论;压不出机制 = 这次只是查了资料
S10独立红队审我执行者≠验证者;与我自评显著背离 = 同源盲点实锤,回 S5 补证
S11决策卡必须写出"为什么不是别的答案"(含被淘汰假设各被几条否证);写不出可执行动作 = 降级"只够理解"
S12观察清单 + 预测登记 + 12 项质量闸每个前瞻指标写清"看到什么算我说对/说错"+中途校验点

DM-05 快答 6 步:锁 crux 并先写下直觉答案 → 立 3 个互斥假设(含 1 反直觉)→ 对称快核(各 1 支持 1 否证)→ 不一致计数 + 置信度 → 决策卡。

这一档最有价值的时刻 = 我的直觉答案被淘汰,必须显式写出来。


三、借什么 / 独有什么(Rule-DEDUP-001:这是装配,不是新引擎)

环节复用现成引擎本协议独有的加法
S2 锁 crux + 反事实标尺Isaac 首席提问官 / CLARITY-7 第 1 步
S4/S7 竞争假设 + 不一致计数a129-ach(Heuer 八步)
S5 采证 E1/GIGOCLARITY-7 第 3 步 / Rule-GIGO-001对称采证 + 显著缺席证据
S6 逐条评分12 维加权 + 置信度算式 + 6 项惩罚 + 三元组
S9 归因收敛CLARITY-7 第 4 步"压成核"硬判据:每机制反解释 ≥3 子问题 + 可检验推论
S10 独立红队Verity / Rule-EVIDENCE-001
S11 决策卡probflow 决策卡模板被淘汰假设与其否证条数一并摆出
S12 预测登记Pythia / 校准账本

明确不替代 CLARITY-7:CLARITY-7 管"怎么一步步想透并出件";DM-04 管"多个答案公平厮杀 + 置信度可追溯 + 写清为什么不是别的答案"。要标准分析出件走 CLARITY-7,要"排除式结论"走 DM-04。


四、验证凭据(真命令真结果)

#检查结果
1格式A 解析仿真(1:1 复刻画板解析器正则)✅ 5/5 全通、无坏引用(步数 11/5/9/12/6
2线上 cases.json 实测✅ v3.3、总数 145、DM-01~05 全在位
3真浏览器端到端(Playwright 实点)✅ chip「🧭 文章辩证解读 5」、5 卡 5 个「在画板打开」
4画板真建图DM-04 = 12 节点(DOM 12)/17 连线/1 循环(成员 2);DM-05 = 6/5/0;DM-01~03 仍 11/5/9 全对;无 JS 错误
5截图真看✅ DM-04 toast「已生成:12节点/17连线/1个循环」,循环虚线框包住 S5 对称采证+S6 辩证卡,联网硬要求徽标在 S5/S8 上
6部署✅ Cloudflare Pages 已上线(本次部署 ID 81aa9e8d)

诚实边界:第 3/4 项跑在本地服务(浏览器直连线上被代理 TLS 重置),用的是与线上完全同一份 sandbox-board.html + cases.json;线上侧由第 2 项 curl 独立核实。未在主席真手机上实点。


五、红队与缺口

1. 最强反对:「你又交了一个工作流,还是没有一次真跑的样例。上一轮已经是'工具没样例',这轮重犯。」

回应成立,这是本次最大缺口。没自跑是因为 DM-04 的产出质量 100% 取决于问题选得对不对,而问题该由主席定(选错题 = 12 步全白跑,且会污染案例 note 里的"自跑样例"链接)。已把"用 DM-04 真跑一个主席指定问题"列为第 1 号下一步。在有真跑样例之前,DM-04 只能算"设计完成",不算"验证有效"。

2. S10 的独立性有天花板:独立 agent 与我同模型,能抓证据真伪/不对称标准/逻辑漏洞,抓不了范式级共享盲点。真要那一层必须升外部异构(Codex/真人,走 external_review_queue)——协议已写明,但本次没跑。

3. 纪律不是机器闸:S5"只有支持没否证就退回"、S7"绝不按支持数选"目前靠执行者自觉。可加一道脚本闸(检查产出是否含矩阵、是否含否证栏、置信度是否带算式),本次未做。

4. 可能的过度工程:12 步对"该不该买杯咖啡"级问题是杀鸡用牛刀。缓解:DM-05 快答档 6 步,且 skill 第 0 步强制先判入口与轻重档。

可证伪锚:主席指定一个问题,我用 DM-04 真跑一遍;若产出的决策卡里写不出"为什么不是别的答案"(被淘汰假设+各自否证条数),或置信度给不出算式,则本工作流设计不合格,回炉。