OpenAI 近日公開了一批數學成果,這些解答由一款尚未發佈的前沿模型生成。此次發佈包含 722 篇手稿,歸入 372 個結果族,同一族內的論文圍繞相關結果組織。據新成立的獨立顧問組織 AGMAI(數學與人工智能顧問組)介紹,這批成果涵蓋“數百個”未解問題。AGMAI 由一批頂尖數學家組成,旨在負責任地對外溝通這些結果。
實際上,外界對這些成果已期待數週,但此前 OpenAI 沒有透露模型解決了哪些具體問題,也沒有説明確切的發佈時間。今年 9 月,該公司曾表示其模型“在數學的大部分領域解決了 100 多個長期未解問題”。此次公開的論文及其他材料還包含部分模型推理摘要、算力使用估算,以及嘗試問題數量的統計。OpenAI 稱,“平均結果”消耗的算力約等於 ChatGPT Pro 思考三個小時。
AGMAI 在 9 月底發佈了首批建議,敦促 AI 實驗室及時發佈數學成果,並儘可能通過既有學術渠道進行,同時披露所用模型名稱、提示詞和算力成本等細節。該組織還呼籲 AI 公司“不要將數學成果的發佈當作推廣自身模型的市場營銷工具”,並指出這種做法會對數學界造成嚴重傷害。
OpenAI 如此描述本次發佈的流程:成果發佈在 GitHub 倉庫中,並制定了論文修訂與引用的協議。公司表示,仍在探索其他符合委員會指南、由社區託管的替代方案。對於未來發布,OpenAI 承諾通過改進引用、數學闡述和結果呈現方式,進一步提升論文質量,以便更好地理解。
這些成果的全面影響可能還需要一段時間才能顯現,因為數學家們需要評估和消化它們。它們加入了 OpenAI 及 Anthropic 等競爭對手實驗室快速增長的數學成果之列,學界仍在處理這些結果,其中包括涉及千禧年大獎難題——該領域最著名的未解問題之一。今年以來,AI 實驗室高速闖入這一學科,尤其是在發佈方式上的處理,已引發關於研究實踐、倫理,以及公司如何認可人類數學家的貢獻——這些人的工作被系統所依賴,並可能被用來產生成果——的激烈辯論。