← Multi-Agent Research

Template 1:开放问题多 agent 头脑风暴

三阶段发散性研究路线图生成器

研究模式(必读)

本模板默认走 Mode A:实质研究(追求可证伪新贡献)。仅当用户请求显式落在 "综述 / survey / 学习 X / 什么是 X / 最新进展" 等触发短语时,切到 Mode B:综述。详见 MODES.md

Stage 0 必须显式记录 mode 到 decision_log.md,所有 Phase 的 agent prompt 都要带 mode=A|B 标记。

用途

当你面对一个开放数学/科学问题没有明确攻克入口时,本模板用多 agent 并行思考来产出一份研究路线图(不是证明)。

输出物是 HTML 章节,结构为:N 个发散角度速览 → N/2 个题对协同 → N/5 个跨主题大综合 → 重定义 → 高优先级可攻命题清单 → 局限性声明。

何时用 vs 不用

不用

已完成示例

mersenne.html §13 — Mersenne 素数无穷性的 10 角度 × 4 阶段(18 agent,约 12 分钟)。

架构

4 阶段流水线:

N 个发散角度 (Q1..QN) │ ▼ ┌─────────────────────┐ │ Phase 1:N 个 agent │ 每人 1 个角度,深挖 │ → phase1_qNN.md │ └────────┬────────────┘ ▼ ┌─────────────────────┐ │ Phase 2:N/2 agent │ 每人 2 角度,找协同与张力 │ → phase2_aXX.md │ └────────┬────────────┘ ▼ ┌─────────────────────┐ │ Phase 3:N/5 agent │ 每人 5 角度,跨主题大综合 │ → phase3_aX.md │ └────────┬────────────┘ ▼ ┌─────────────────────┐ │ Phase 4:1 agent │ 读全部,写最终 HTML 章节 │ → final_section.html│ └─────────────────────┘

推荐参数

$N$(角度数)Phase 1Phase 2Phase 3总数适用
663111快速探索
10105218推荐默认
15157326深度探索

模型选择:发散阶段强烈推荐全部使用 Opus 4.7(默认)。Sonnet 4.6 倾向给"教科书清单";Opus 在跨领域联想和非平凡角度上明显更密。成本估计(Opus 4.7):18 agent × ~5K tokens ≈ 90K tokens,约 \$3–6。Sonnet 4.6 约 \$0.5–1,作为预算紧张时的降级选项。

角度设计原则

每个角度应回答一个截然不同的方法论问题。Mersenne 例子的 10 角度可作模板:

ID角度类型模板提问
Q1历史方法重用历史上证此类问题的 5 大手法(X, Y, Z)哪些可改造?
Q2跨学科类比物理 / 生物 / CS 中有无结构同形的对应物?
Q3算法迁移ML / 量子 / 谱 / SAT 等算法能否用于"算法式证明"?
Q4经典启示Euler / Dirichlet 类经典证法能否变形?
Q5等价重述翻成动力系统 / 几何 / 拓扑 / 范畴语言哪个易攻?
Q6拆分逼近像 Goldbach $1+1 \to 1+2 \to \ldots$ 的阶梯式拆分?
Q7新框架跳出现有体系需发明什么对象?
Q8信息论Kolmogorov / 随机性 / PRF 假设视角?
Q9跨猜想杠杆哪个其他大猜想成立可蕴含?哪个最弱、最近?
Q10反证假设否定推矛盾?借助哪些已证事实?

实施步骤

步骤 0:准备

mkdir -p /tmp/myproject_brainstorm
mkdir -p ./output_dir   # 最终 HTML 写入位置

步骤 1:写出 N 个角度

把问题陈述 + 已知背景 + N 个角度写到一个素材文件,准备分发给各 agent。

步骤 2:Phase 1(并行)

对每个角度 $Q_k$ 启动一个 general-purpose agent,默认 Opus 4.7(Sonnet 4.6 为降级选项),提示模板见 markdown 版(.md 文件,"步骤 2"段)。

关键:并行启动全部 N 个 agent(一个 Agent 工具调用块包含 N 次 invoke)。

步骤 3:Phase 2(并行配对)

把 N 个角度配成 $N/2$ 对(语义相邻的放一起),每对启动一个 agent 找协同 + 张力。

步骤 4:Phase 3(少量大综合)

把 N 题分成 $N/5$ 组,每组 5 题,每组一个 agent 找跨题大主题。

步骤 5:Phase 4(最终综合)

一个 agent 读全部产出,写最终 HTML 章节,结构:

  1. §N.0 引子(方法 + 价值定位 = 路线图非证明)
  2. §N.1 N 个发散角度速览(表格)
  3. §N.2 第二阶段题对协同(每对 1-2 段)
  4. §N.3 第三阶段大综合(识别 3-5 个真正跨题大主题)
  5. §N.4 重定义:原命题应作为什么样的研究问题(短期/中期/长期)
  6. §N.5 高优先级可攻小命题(3-5 个)
  7. §N.6 局限性与诚实告示(LLM 头脑风暴的风险)

步骤 6:插入到主文档

读 phase4_section.html,用 Edit 工具插入到目标 HTML 的指定位置。

输出物清单

/tmp/myproject_brainstorm/
  phase1_q01.md ... phase1_qN.md     (N 份单题深探)
  phase2_a01.md ... phase2_a(N/2).md (N/2 份题对)
  phase3_a1.md, phase3_a2.md         (~N/5 份大综合)
  phase4_section.html                (最终 HTML 章节)

局限性

已知失败模式

正因如此,Template 1 的输出只是入口候选,每个候选必须再用 Template 2 严格验证才能下结论。

何时升级到 Template 2

当 Template 1 的高优先级清单中的某条命题需要严格验证 / 想真证它时,把那条命题作为 Template 2 的输入启动深入研究。