推文
@TiagerBao · 2026-10-10 06:40
Anthropic 现在让 Claude Code 用几十个甚至上百个 Agent,围着一道数学题一直证明下去。 官方刚放出的插件叫 math-proof,专门处理难度比较高、甚至研究级的数学问题。 它有两种模式: /math-proof:solo 一个 Claude 自己做题,但不是一口气硬想。 每得到一个中间结论,就先写进 notes.md,哪怕输出被截断,下次也能从已经证明的地方继续。 更狠的是: /math-proof:siege 这不是一个 Agent 做题,而是一整套多 Agent 流程。 每轮先由 Judge: 拆出几个独立问题 ↓ 多个 Worker 并行求解 ↓ Judge 汇总结果 ↓ 把结论标成 PROVED / REFUTED / OPEN ↓ 继续盯着还缺的那一步往下攻 如果某个 Worker 给出了完整证明,还不能直接结束。 会再叫 两个独立 Worker,对这份证明逐行检查。 默认最多跑 14 轮。 前几轮最多 4 个问题一轮,后面可以提高到 10 个。真跑满的话,README 直接提醒:可能会调用 100+ 次 sub-agent,先看 /usage。 最后统一生成一个 proof.md,并明确写清楚: 到底证明了什么,还有什么没证明。 整个运行过程默认还把 WebSearch / WebFetch 关掉,主要靠模型自身推理,不是一边搜答案一边拼。 这个方向挺有意思: 以前是让一个大模型“再想久一点”。 现在开始变成: 拆问题 → 多人独立证明 → Judge 汇总 → 双重审查 → 继续补缺口。 数学证明也开始被做成 Agent workflow 了。 GitHub:https://github.com/anthropics/claude-plugins-official 插件:math-proof #Claude #ClaudeCode #Anthropic #AI #Agent #Math #MultiAgent
曝光 182 · 评论 4 · 点赞 5 · 书签 2