刚刚,OpenAI 把一个内部前沿模型做出来的数学成果,一股脑放上了 GitHub
来源:OpenAI 官方账号
Github 仓库位于 openai/math,里面收了 722 篇论文,并把结果归成 372 个族,涉及大约 4000 道问题,平均每个结果,花掉约 3 小时 ChatGPT Pro 的思考算力
如果你打开第 003 号,会发现惊人的一幕:OpenAI 宣称,它证明了准黎曼假设
这事儿,非常离谱,眩晕瘫坐了算是
OpenAI 的这份 pdf
整个 PDF 一共 41 页,按数论、代数几何、理论计算机、数学物理等 17 个学科排开,数论打头
总览第 2 页,数论部分
数论这里面所涉及到的问题,每条都悬了几十年,比如...
准黎曼假设(003):黎曼假设说,ζ 函数的非平凡零点全都落在实部 1/2 那条竖线上。退一大步,只问"实部大于某个比 1 小的数,那片区域里一个零点都没有",此前也没人证出来。003 说:实部大于 7/8 的地方,没有零点
有理数版希尔伯特第十问题(004):有没有一个算法,能判断任意一个整系数多项式方程有没有有理数解。整数版 1970 年由马季亚谢维奇收尾,答案是没有;有理数版一直悬着。004 说:也没有
卡塔兰常数是无理数(005):1 − 1/9 + 1/25 − 1/49 + …… 一路加下去得到的这个数,是不是分数,一直没人知道。005 说:不是
π 的无理性指数是 2(017):用分数去逼近 π,逼不出比一般无理数更好的精度。此前能证到的上界在 7.1 左右。顺手还证了 Flint Hills 级数收敛,一个长得很简单、却没人判断得了的级数
BSD 猜想的一大块(002、006):BSD 是七个千禧年大奖难题之一。这里没证全,证的是:任取一条有理数上的椭圆曲线,它的二次扭曲里,密度为 1 的那部分都满足完整的 BSD 公式
往后翻,还有 CM 阿贝尔簇上的霍奇猜想、正特征下几何朗兰兹的一个版本、一串推翻 Kaplansky 猜想的反例,和一长串埃尔德什问题
这里得补充一下:此处编号只是目录顺序,不代表排名(编号第三的是准黎曼假设)
怎么来的
这批论文,是 OpenAI 拿开放研究问题评测模型时攒下的,毕竟现有的数学评测被做满了,考卷就换成了人类还没解开的题
于是 OpenAI 就把找到了大约 4000 道“人类未解之谜”拿去 bench、把结果汇总成族,再按"够分量"筛一遍,剩下 372 族
作为新文档另一层面,在过去两个多月里,OpenAI 已经发了四轮学术公开:
8 月 1 日:OpenAI 发布《数学与理论计算机科学的十项进展》,10 个结果
9 月 8 日:OpenAI 说,内部模型解决了纳维–斯托克斯千禧年难题,证明光滑的流体能在有限时间里冒出奇点。最后得手的那组,约 1 万个智能体并行跑了 88 小时,用的模型 8 月 28 日才开始训练
9 月 21 日:OpenAI 说,同一个内部模型又解决了 100 多个公开问题
10 月 6 日:722 篇论文,一次放出
仓库里每篇论文的目录名都带着日期,你可以根据日期看到模型的每日突破,比如 9 月 23 日 177 篇,9 月 24 日 193 篇
署名栏:此处无人
问题验证
模型解决了很多问题,验证的方法也在与时俱进,Lean 便是证明写成代码,交给电脑一步步核
对于准黎曼假设,通过 Lean 来表达,核心便只有下面三行:
theorem riemannZeta_ne_zero_of_seven_eighths_lt_re
{s : ℂ} (hs : (7 / 8 : ℝ) < s.re) : riemannZeta s ≠ 0 := by
sorry翻成人话:任取一个复数 s,只要它的实部大于 7/8,ζ(s) 就不等于 0,对了...末尾的 sorry 是占位符,意思是「证明待填」,OpenAI 所做的,就是把这个 sorry 填满
而判卷则是通过 Comparator 的程序完成:
题面是同一个命题
只用了三条标准公理
Lean 内核逐步检查,全部通过
OpenAI 开发者论坛上,已经有人自己编译了一遍:2924 个模块,零错误零警告
仓库里的形式化清单收了 162 篇论文的主结果,而对于剩下的五百多篇,眼下只有论文本身,只能回到老办法:人读
数学家们眩晕瘫坐
9 月,25 位菲尔兹奖得主联名发了公开信,说 AI 正在威胁数学家的智力工作
9 月 21 日,OpenAI 宣布成立数学与 AI 顾问组,挂在普林斯顿高等研究院。成员由九位知名数学家组成,包括高尔斯、海雷尔、威滕、梅兰妮·伍德...这些人不从 OpenAI 拿钱,也不归 OpenAI 管9 月 29 日,顾问组参考六百多份问卷,发了一份 AI 实验室发布数学成果的指南。OpenAI 说,这次发布参考了这份指南:仓库带版本记录和引用格式,附上 Lean、10 份推理摘要、算力口径和问了多少题等等
逻辑学家 Jeremy Avigad 前天在陶哲轩博客上写:
一年前还算体面、能正经发表的那类结果,现在借助 AI 就能轻松生成。这让我们开始担心,往后做数学意味着什么,又该怎么培养下一代数学家
OpenAI 发布当天,顾问组也发了声明
IAS 顾问组,10 月 6 日
对于这些研究来说,成果公开只是第一步,人类还需要理解这些工作、并把它们收进数学知识
科学研究是真踏入了奇点了...




