OpenAI 近日公开了一批数学成果,这些解答由一款尚未发布的前沿模型生成。此次发布包含 722 篇手稿,归入 372 个结果族,同一族内的论文围绕相关结果组织。据新成立的独立顾问组织 AGMAI(数学与人工智能顾问组)介绍,这批成果涵盖“数百个”未解问题。AGMAI 由一批顶尖数学家组成,旨在负责任地对外沟通这些结果。
实际上,外界对这些成果已期待数周,但此前 OpenAI 没有透露模型解决了哪些具体问题,也没有说明确切的发布时间。今年 9 月,该公司曾表示其模型“在数学的大部分领域解决了 100 多个长期未解问题”。此次公开的论文及其他材料还包含部分模型推理摘要、算力使用估算,以及尝试问题数量的统计。OpenAI 称,“平均结果”消耗的算力约等于 ChatGPT Pro 思考三个小时。
AGMAI 在 9 月底发布了首批建议,敦促 AI 实验室及时发布数学成果,并尽可能通过既有学术渠道进行,同时披露所用模型名称、提示词和算力成本等细节。该组织还呼吁 AI 公司“不要将数学成果的发布当作推广自身模型的市场营销工具”,并指出这种做法会对数学界造成严重伤害。
OpenAI 如此描述本次发布的流程:成果发布在 GitHub 仓库中,并制定了论文修订与引用的协议。公司表示,仍在探索其他符合委员会指南、由社区托管的替代方案。对于未来发布,OpenAI 承诺通过改进引用、数学阐述和结果呈现方式,进一步提升论文质量,以便更好地理解。
这些成果的全面影响可能还需要一段时间才能显现,因为数学家们需要评估和消化它们。它们加入了 OpenAI 及 Anthropic 等竞争对手实验室快速增长的数学成果之列,学界仍在处理这些结果,其中包括涉及千禧年大奖难题——该领域最著名的未解问题之一。今年以来,AI 实验室高速闯入这一学科,尤其是在发布方式上的处理,已引发关于研究实践、伦理,以及公司如何认可人类数学家的贡献——这些人的工作被系统所依赖,并可能被用来产生成果——的激烈辩论。