一个想法进去,一份经过四轮对抗审查的方案出来。对抗式方案生成 → 投资人批判 → 零上下文单盲复审 → 方向漂移检测与回退 → 前提拆台分级;写与审来自不同厂商、不同对齐路线,具备多出口回退循环,关键节点提供 HITL 人工判断。
默认:Claude × 4 + DeepSeek × 2 + GLM × 1 · 跨维度是硬规则,具体模型可替换
写一段产品想法,看它走完全部 13 步:两个对立的专家各出方案、融合、四轮批判与修订。每一步谁在跑、花了多少、产出了什么都会摊开。
P1 对抗式方案生成——两位底模坐标不同的专家各自独立出方案,由执笔者融合成 v1。
P2 四轮批判链——投资人批判 → 零上下文单盲复审 → 方向漂移检测与回退 → 前提拆台与致命论据分级。写方案的与审方案的来自不同厂商、不同对齐路线,不让同一个模型既写又审。
多出口循环——拆台判定驱动回退:回 P1 整链重跑、回 P2 重压批判链、结构性死锁退出,两轮封顶。
HITL 节点——在方向回退与拆台判定两个关键节点提供人工判断选项,auto / hitl 两档可切换。
flowchart TB classDef anchor fill:#F0EEE6,stroke:#B0AEA5,color:#141413 classDef divA fill:#E4ECF2,stroke:#8FA3B3,color:#141413 classDef divB fill:#E8F0E6,stroke:#8FB08F,color:#141413 classDef hitl fill:#FBEFE9,stroke:#D97757,stroke-width:2px,color:#141413 classDef route fill:#FFF4D6,stroke:#C9A227,color:#141413 classDef exitA fill:#F8DADA,stroke:#B04141,color:#141413 classDef exitB fill:#DCEEF3,stroke:#3E7A8C,color:#141413 classDef exitC fill:#E9E8E4,stroke:#666,color:#141413 classDef done fill:#141413,stroke:#141413,color:#FAF9F5 SEED([原初想法]) --> P0[P0 忠实精炼
anchor] P0 --> P10[P1.0 生成对抗角色
anchor · 假对立检测] P10 -. 假对立 → 重生成 ≤1 次 .-> P10 P10 --> P1A[P1A 专家 A
anchor] P10 --> P1B[P1B 专家 B
divergent_a · 与 A 互不可见] P1A --> P14[P1.4 融合 → v1
anchor 执笔] P1B --> P14 P14 --> P2A[P2A 投资人批判
anchor · 新窗口] --> AF[2A-fix → v2
执笔] AF --> P2B[P2B 零上下文单盲
divergent_b · 只见正文] --> BF[2B-fix → v3
执笔] BF --> P2C[P2C 知情复审
anchor · 对照 v1/v3 查漂移] P2C --> CR[2C-rollback → v4
执笔按诊断自判回退] CR --> P2D[P2D 拆台
divergent_a · 只攻前提] --> DF[2D-fix → v5
执笔分级判定] DF --> R1 R1{致命论据 ≥ 2?
K 级 × 具体性高} R1 -- 否 --> V5[产出 v5] R1 -- 是 · 第 1 轮 --> EA[出口 A · 回 P1
整链重跑] R1 -- 是 · 第 2 轮 · 议题重叠 ≥ 60% --> EC([出口 C · 结构性死锁]) R1 -- 是 · 第 2 轮 · 重叠 < 60% --> FORCE[终止条件兜底
强制产出 v5] --> V5 V5 --> R2{K 占比 ≥ 60%
且第 1 轮?} R2 -- 是 --> EB[出口 B · 回 P2
v5 当新初稿] R2 -- 否 --> END([结束]) EA -. 新一轮 · 窗口全新开 .-> P0 EB -. 新一轮 · 只重跑批判链 .-> P2A class P0,P10,P1A,P14,P2A,AF,BF,P2C,CR,DF anchor class P1B,P2D divA class P2B divB class R1,R2 route class EA exitA class EB exitB class EC exitC class END,V5 done
flowchart TB classDef anchor fill:#F0EEE6,stroke:#B0AEA5,color:#141413 classDef divA fill:#E4ECF2,stroke:#8FA3B3,color:#141413 classDef divB fill:#E8F0E6,stroke:#8FB08F,color:#141413 classDef hitl fill:#FBEFE9,stroke:#D97757,stroke-width:2px,color:#141413 classDef route fill:#FFF4D6,stroke:#C9A227,color:#141413 classDef exitA fill:#F8DADA,stroke:#B04141,color:#141413 classDef exitB fill:#DCEEF3,stroke:#3E7A8C,color:#141413 classDef exitC fill:#E9E8E4,stroke:#666,color:#141413 classDef done fill:#141413,stroke:#141413,color:#FAF9F5 SEED([原初想法]) --> P0[P0 忠实精炼
anchor] P0 --> P10[P1.0 生成对抗角色
anchor · 假对立检测] P10 -. 假对立 → 重生成 ≤1 次 .-> P10 P10 --> P1A[P1A 专家 A
anchor] P10 --> P1B[P1B 专家 B
divergent_a · 与 A 互不可见] P1A --> P14[P1.4 融合 → v1
anchor 执笔] P1B --> P14 P14 --> P2A[P2A 投资人批判
anchor · 新窗口] --> AF[2A-fix → v2
执笔] AF --> P2B[P2B 零上下文单盲
divergent_b · 只见正文] --> BF[2B-fix → v3
执笔] BF --> P2C[P2C 知情复审
anchor · 对照 v1/v3 查漂移] P2C --> CR[2C-rollback → v4
执笔] CR --> H1{{★ HITL ① 停下等你
诊断 + 「当初要 X → 现在变成 Y」}} H1 -- 接受 --> P2D H1 -- 指定回退 / 指定保留
带指令重跑 --> CR P2D[P2D 拆台
divergent_a · 只攻前提] --> DF[2D-fix → v5
执笔分级判定] DF --> H2{{★ HITL ② 停下等你
分级表 + 判定}} H2 -- 按判定走 --> R1 H2 -- 框架内改
带指令重跑 --> DF H2 -- ★ 前提错了 --> EA R1{致命论据 ≥ 2?
K 级 × 具体性高} R1 -- 否 --> V5[产出 v5] R1 -- 是 · 第 1 轮 --> EA[出口 A · 回 P1
整链重跑] R1 -- 是 · 第 2 轮 · 议题重叠 ≥ 60% --> EC([出口 C · 结构性死锁]) R1 -- 是 · 第 2 轮 · 重叠 < 60% --> FORCE[终止条件兜底
强制产出 v5] --> V5 V5 --> R2{K 占比 ≥ 60%
且第 1 轮?} R2 -- 是 --> EB[出口 B · 回 P2
v5 当新初稿] R2 -- 否 --> END([结束]) EA -. 新一轮 · 窗口全新开 .-> P0 EB -. 新一轮 · 只重跑批判链 .-> P2A class P0,P10,P1A,P14,P2A,AF,BF,P2C,CR,DF anchor class P1B,P2D divA class P2B divB class R1,R2 route class EA exitA class EB exitB class EC exitC class END,V5 done class H1,H2 hitl
图例:anchor 执笔 / 专家 A / 投资人 / 知情复审 divergent_a 专家 B / 拆台 divergent_b 单盲 HITL 停点 auto 自动通过,hitl 停下等你 虚线 = 回边。两个档位走同一张图。演示档:anchor = gpt-5.6-luna(A2·B1)、divergent_a = deepseek-v4-flash(A3·B3)、divergent_b = glm-4-flash(A3·B2)。
批判步和修改步交替:每一次批判来自一个新开的、坐标不同的窗口;每一次修改都由同一个执笔窗口完成——分歧在审查环节,不在修改环节,否则方案会变成多个 AI 的拼贴。
最多两轮、单链 $3 封顶。循环是工程层的实现;方法论本体的立场是「回不回退由人判断」,这里把它交给了规则。
选型分两件事判:坐标判不判得了(硬规则管这个)、能力够不够用。同坐标的模型共享对齐栈和语料文化,因此共享盲区——全 Claude 覆盖等于假覆盖。
| 维度 A · 冲突偏向 | 含义 | 代表 |
|---|---|---|
| A1 规范优先 | 有一份独立于任务的成文规范,冲突时规范压过任务 | Claude、Gemini |
| A2 权限优先 | 规范是「谁说了算」的权限链,不是价值命题 | GPT |
| A3 任务优先 | 公开材料里没有独立规范层,奖励全部来自任务完成度 | DeepSeek、Kimi、GLM |
| 未公开 | 后训练目标未公开,判不了坐标——不进入任何组合 | Qwen、豆包、MiniMax |
维度 B · 语料文化:B1 英文母语 / B2 中文母语 / B3 跨文化双核。P2 批判链必须跨至少一维。
| 窗口 | 坐标 | 承担 |
|---|---|---|
| 执笔 | A1·B1 | 写初版并执行全部修改 |
| 专家 A | A1·B1 | P0 精炼、P1 出方案 |
| 专家 B | A3·B3 | 独立出方案,看不到 A |
| 投资人批判 | A1·B1 | 新开窗口,没有作者包袱 |
| 单盲复审 | A3·B2 | 零上下文,只收方案正文 |
| 知情复审 | A1·B1 | 对照 v1 与 v3 查方向漂移 |
| 拆台 | A3·B3 | 必须由任务优先坐标承担 |
A1·B1 + A3·B3 + A3·B2。两维都跨,坐标三个各不相同。本站演示用的是同结构的便宜档:GPT + DeepSeek Flash + GLM Flash。
整体换成 GPT(A2·B1)做锚。跨冲突偏向仍成立,只是 A 侧不是 A1 极端点。
单盲和拆台共用同一坐标的不同会话。仍跨中西两侧,但中文侧坍缩成一点,建议单盲的提示词纪律更严。
Claude × 7 不同窗口号,或 Claude + GPT + Gemini。看似独立的四条批判可能一起漏掉同一块维度。硬规则直接拒绝开跑。
任何一对窗口都应在四个维度不同:AI 身份、角色、上下文、范围。四轴完全一致只是一个批判者,不是两个。
四轮批判必须跨至少一维。同坐标 = 假覆盖。这一条由代码在开跑前检查,不过不开跑。
单盲窗口只收到方案正文。一旦给背景,它就开始猜意图,机制当场失效。窗口主动拒绝任何注入历史的尝试。
执笔窗口负责所有修改,批判者和复审者各自新开。一个窗口复用多角色会让机制整体坍塌。
一次处理一条批判。四条一起上会逼人同时持有四个框架,必然选择性忽略。
细节错漏属于投资人批判那一轮。知情复审问的是:响应完前两轮之后,是否已从最初的核心定位偏移。