AI 新聞·2026年10月9日·來源: Phys.org
這是「數學末日」嗎?為何OpenAI最新發佈的成果讓數學家震驚
OpenAI最近發佈了722篇與372個開放數學問題相關的論文,這些論文主要由一個尚未發佈的AI模型生成。這次發佈的內容包括聲稱在千禧年大獎難題(如黎曼假設)上取得進展。該公司表示其動機是推動數學發展,儘管據報導有些論文難以理解。
Nexa 摘要
OpenAI發佈數學成果的龐大數量和方式在數學界引起了廣泛討論。儘管有些論文聲稱在備受矚目、長期存在的難題上取得了重大突破,但其隨附文檔的可理解性受到了質疑。專家,包括文章中提到的一位資深同事,甚至OpenAI自己的大型語言模型ChatGPT(GPT-5.6 Sol),都發現至少一項備受矚目的成果是「嚴重的幻覺」,在未經專家審核的情況下不應引用。這表明AI的問題解決輸出與其以人類可理解或可驗證的格式呈現結果的能力之間存在脫節。
OpenAI聲明發佈這一大量成果的動機是「促進數學的進一步發展」。然而,驗證和解釋結果的挑戰,加上一些撤回和修訂,意味著這種發佈方式可能不利於實現這一目標。該公司也可能希望擺脫早期的爭議,例如關於其聲稱解決納維-斯托克斯問題的指控,當時研究人員聲稱OpenAI獲取了他們的數據並使用了他們的想法。
OpenAI更廣泛的戰略影響可能與通用人工智能(AGI)的概念有關。AI模型執行研究級數學的能力,這是一門依賴複雜論證和客觀真理的學科,可能會為這些模型正在接近AGI的觀點提供可信度。這種看法可能有利於OpenAI在其據報導的股票市場上市之前,該公司希望實現高達1.4萬億美元的估值。然而,目前人類驗證的困難突顯出,即使AI能夠生成潛在的解決方案,數學家之間建立共識的過程對於驗證數學真理仍然至關重要。






