昨天的早晨,或许将成为人类历史上一个重要的分水岭。尽管我提前做了大量准备,积累了一些知识,但撰写这篇文章却花费了整整一天,最终在今日清晨六点十五分才完成。背后的原因无他,这一事件的信息量巨大,其历史意义深远;在调研和写作的过程中,一次次的情绪波动让我倍感沉重。这一突发事件已经引起了广泛的关注,发生在10月7日,OpenAI毫无预兆地向公众发布了一系列令人震惊的数学研究成果。他们在GitHub上创建了一个新仓库,名为openai/math。在这个平台上,有多达722份数学手稿,和372个相关成果,涵盖数论、代数几何、实分析、组合数学、理论计算机、数学物理、偏微分方程等多个领域,所有内容均源于OpenAI内部一款尚未公开的模型。
722篇论文的数量,令人难以置信,这相当于什么呢?在著名的arXiv平台上,每月每位研究人员只能提交两篇论文,若由人为完成,传递这些论文的过程可能需要人类花费整整30年的时间。而作为科学基础的数学,其重要性不言而喻,更是理科界的“女王”。在短短的一夜之间,命运的齿轮仿佛不再缓缓转动,而是以一种惊人的速度向前推进,像是突破了某种界限,形成了一个令人目瞩的高峰,俯瞰着我们,似乎在无声地挑战我们的理解。
随后的24小时里,全球都陷入了一种沸腾的状态,有人的欢呼雀跃,也有人的愁苦失落。一位网友的评论正是我内心的真实写照。“这是一个混沌的时代,更是一个底层科学指数级爆炸的时代。”回想起《三体》中描绘的技术大爆炸,我们似乎正在见证一个崭新时代的来临。作为一个数学领域的外行,尽管我曾在两个月前大量补习相关知识,但在人工智能的助力下,学习的速度大为加快。家人和朋友中有数学专业人士,给予了我很多帮助,使我对这一前沿科技有了初步的理解。在此,我希望能通过自己的文字,帮助读者们更深入地理解这一令人震撼的时刻。那么,系好安全带,我们的探索正式开始。 qmh
一. 发生了怎样的变革?
这722份数学手稿被汇集为372个成果组。在数学界,成果的产生常常伴随众多推论、补充论证或是对不同思路的证明。因此,OpenAI将这些相互关联的成果组织在了一起。这些成果的来源又是如何?OpenAI表示,现有的数学评测系统已经接近饱和。例如,全球最优秀的高中生每年参加的国际数学奥林匹克比赛中,AI在去年便达到了金牌水平,常规数学题库也已被充分利用,分数的提升不再能有效反映能力。想要进一步评估模型的数学能力,OpenAI挑选了大约4000个尚待解决的“开放问题”,并输入到那款未公开的内部模型中,最终筛选出这些有分量的372组成果。
对OpenAI在科研方面的能力,大家无需过多怀疑。尽管在编程领域,Claude模型可谓是大放异彩,但在科学研究中,GPT模型依然保持着领先水平。那个内部模型当中,每个结果的生成平均耗时约3小时,相当于ChatGPT Pro的推理能力。这个时间长度让许多人不禁为之震惊,因为其中的一些问题,真正的数学家们可能探索了数十年而未能解决。而OpenAI的首席执行官Altman在当天发推表示:“你的海洋如此浩瀚,我的船只如此渺小。”我相信每一个与前沿AI对话过的人,在面对AI的无限可能时,心中或多或少也曾涌起这样的念头。 qmh
二. 数学的真正面貌
在发布后,数学界人士纷纷发声,情绪各异,波澜壮阔。罗格斯大学数学系主任、知名数论学者Alex Kontorovich在看到“准黎曼猜想”这一条目时,不禁惊呼:“准黎曼????你在开玩笑吗?”他进一步表示,若这是人类数学家所做,毫无疑问将会直通菲尔兹奖的殿堂。这一激动的反应背后,反映出数学与其他学科的不同之处。深入了解这一差异,便会发现,数学的核心在于“证明”。
与物理、化学和生物等诸多学科依赖实验形成理论的方式不同,数学自始至终是建立在严谨的公理基础之上的,每一个推导都环环相扣。只要一个命题经过了充分的证明,在相同的公理和规则下,它便将永远不变,不会被时间所冲击或推翻。正如两千三百年前,欧几里得在《几何原本》中进行的证明,至今依然有效。为了帮助理解这一点,我们来看看一个具体的数论问题,假设我们询问:“素数是否存在最大的一个?” qmh