
OpenAI近日在GitHub发布了722份手稿,其中包含针对372个重大数学问题的数百个解决方案及最新进展。这些成果源自一款未公开的ChatGPT先锋模型,经OpenAI新成立的顾问组确认,此举很可能进一步激化数学界关于人工智能应用的争议。
此前,OpenAI曾透露其模型已解决“大多数数学领域中100多个长期悬而未决的开放性问题”,因此此次发布并不令人意外。作为公开内容的一部分,OpenAI提供了模型的推理过程、算力估算以及尝试解决的问题数量等信息。该公司表示,“平均而言”,完成一项结果需要大约三小时的ChatGPT Pro使用时长。
遵循指南但保留关键细节
OpenAI表示,此次发布遵循了其独立数学与人工智能顾问组(AGMAI)推荐的指南,包括通过传统学术渠道快速发布结果,并提供所用模型名称、提示词(prompts)及算力成本等细节。
“对于本次发布,我们在GitHub仓库中公开了结果,并制定了论文修订和引用的协议,”该公司写道,“我们仍在探索符合委员会指南的其他社区托管替代方案。对于未来的发布,我们致力于通过引用、数学阐述和结果展示来进一步提高论文质量,以便更好地理解。”
不过,OpenAI并未完全采纳董事会的所有建议,例如未公布具体问题的计算时间或所使用的详细提示词。据媒体报道,几乎每篇论文都是通过对单个AI代理发出单一提示后生成的。
关键成果与学界质疑
OpenAI声称取得了一些关键突破,包括四维卡凯亚猜想(Kakeya conjecture)的解法、对关键计算机算法的改进,以及在极具挑战性的黎曼猜想方面取得的进展。
然而,在数学家正式评估这些结果之前,其实际影响力尚难定论。继“纳维-斯托克斯方程”争议之后,科学界仍存有大量怀疑态度。麻省理工学院数学家安德鲁·萨瑟兰(Andrew Sutherland)指出:“除非他们发布模型且人们能够复现其结果,否则我认为应将任何关于‘单次提示解决难题’的主张视为未经证实。”