[AI]《Stellar Colosseum: A Many-Agent Harness for Long-Horizon Research in Mathematics and Theoretical Computer Science》H Lin, D P. Woodruff, Y Deng, J Mao… [Google Research] (2026)
在 AI数学研究领域,长篇证明是一个悬而未决的难题。过去的方法受困于单次生成或简单修正,本质原因是它们缺乏一个能驾驭战略选择、依赖管理和错误累积的系统性研究框架。
本文的核心洞见是:把长篇证明重新看作一个多阶段、可管理的工程。由此,「并行生成、对抗证伪、分层聚合」这一关键操作,将探索、分解与修订系统化,使复杂推理得以有序展开。
这项工作真正留下的遗产是一种可复用的“研究流程编排”蓝图。它为后来者打开的新门是,将 AI从“解题工具”变为可系统性攻克开放问题的“研究伙伴”,但尚未跨过的门槛是让流程自我优化,动态分配算力。
arxiv.org/abs/2609.15983 机器学习 人工智能 论文 AI创造营

