AI 新闻·2026年10月9日·来源: Phys.org
这是“数学末日”吗?为何OpenAI最新发布的成果让数学家震惊
OpenAI最近发布了722篇与372个开放数学问题相关的论文,这些论文主要由一个尚未发布的AI模型生成。这次发布的内容包括声称在千禧年大奖难题(如黎曼假设)上取得进展。该公司表示其动机是推动数学发展,尽管据报道有些论文难以理解。
Nexa 摘要
OpenAI发布数学成果的庞大数量和方式在数学界引起了广泛讨论。尽管有些论文声称在备受瞩目、长期存在的难题上取得了重大突破,但其随附文档的可理解性受到了质疑。专家,包括文章中提到的一位资深同事,甚至OpenAI自己的大型语言模型ChatGPT(GPT-5.6 Sol),都发现至少一项备受瞩目的成果是“严重的幻觉”,在未经专家审核的情况下不应引用。这表明AI的问题解决输出与其以人类可理解或可验证的格式呈现结果的能力之间存在脱节。
OpenAI声明发布这一大量成果的动机是“促进数学的进一步发展”。然而,验证和解释结果的挑战,加上一些撤回和修订,意味着这种发布方式可能不利于实现这一目标。该公司也可能希望摆脱早期的争议,例如关于其声称解决纳维-斯托克斯问题的指控,当时研究人员声称OpenAI获取了他们的数据并使用了他们的想法。
OpenAI更广泛的战略影响可能与通用人工智能(AGI)的概念有关。AI模型执行研究级数学的能力,这是一门依赖复杂论证和客观真理的学科,可能会为这些模型正在接近AGI的观点提供可信度。这种看法可能有利于OpenAI在其据报道的股票市场上市之前,该公司希望实现高达1.4万亿美元的估值。然而,目前人类验证的困难凸显出,即使AI能够生成潜在的解决方案,数学家之间建立共识的过程对于验证数学真理仍然至关重要。






