随笔

数学氢弹雨

从开源数学成果、AI 推理与形式化证明,想到知识生产、验证成本以及人类在新纪元中的位置。

OpenAI 官方正式宣布并上线了开源仓库 openai/math。在这个仓库中,包含了 722 篇数学手稿,被归纳为 372 个成果族。
这些成果出自一个尚未公开的内部前沿推理模型。它测试了约 4000 个开放式数学问题,最终的首阶段破局成功率约为 18%。剩下的 82% 处于黑暗的逻辑迷雾中。在这批成果中,包含了诸多数学家穷尽一生都无法攻克的领域核心难题:它一致性地排除了朗道-西格尔零点,让张益唐老师的论文失去了填补漏洞的必要性;它证明了复数域上具有复乘(CM)的阿贝尔簇的有理霍奇猜想;它在脱离唯一游戏猜想(UGC)的前提下确立了 Basic-SDP 阈值的普通 NP-困难。

这场被称为“数学氢弹雨”的突袭,给学术界带来了最直接的肉体痛感。一位叫 captain Violet 的纯数学在读博士写道:“我正在做的一个问题可能被openai爆掉了,震惊瘫坐之余,天终于塌到我头上了……” 当旁人安慰他这可能只是大模型的幻觉时,他给出了最绝望的理性回应:“它写对的概率比我写对的概率大。”

在前 AI 时代,这 722 篇论文里随便挑出一两篇,就足以在世界前 50 的顶尖名校换取一个终身教授教职。但在今天,AI 解出平均某一道世纪数学难题,在后台高强度自我博弈(Self-Play)所消耗的净计算量,仅仅等价于单个 ChatGPT Pro 账户连续思考 3 个小时。

这推翻了数学界曾经广为流传的精英主义观点——“多数数学家的研究,只是帮天才们节约了一个下午茶的时间”。在这场 30 天内完成功耗重力塌陷的闪电战中,因果关系被彻底倒置:多数人类天才一生的研究和心血,最终被封装成了数据集,用来帮 AI 在 3 小时长程推理中避免走弯路。人类天才,成为了帮 AI 节约下午茶时间的垫脚石。

这一极速坍缩的算力代价和庞大的成果体量,让另一个同样位列全球 Top 1 的推理模型 DeepSeek 在未联网的专家模式下,基于旧世界的逻辑和概率模型做出了错误的防御性断定:“这是幻觉式数学新闻,或者某种未来设定”。

现实的国际地缘博弈不存在乌托邦式的幻想。AI 模型的本质是一串数字权重,它具有完美的军民两用属性。限制 AI 意味着单方面阉割国家的经济竞争力、工业效率和未来的科学天花板。因此,全球政府绝不可能联手限制,局势只会演变成一场“蒙眼狂奔”的绝对内卷。

及至那日,人将七百余卷数学新稿陈列于众人面前,宣告其中的论证出于人所造的机器。众人便惊异:有人欢呼,仿佛旷野中忽然涌出泉水;有人默然,想起自己多年敲叩的门;也有学者点起灯,逐行查验,因真理不随喝彩增减,证明也不因奇异而免于审问。人曾教机器数算,如今却须俯身研读机器送来的经卷。于是,守望者对惊异的人说:“莫因门被推开,就以为行路已经完成;答案可以递到手中,明白仍须你们寻求。”

生产知识的边际成本正在降向零,但验证知识的成本正在无限趋近于无穷大。目前只有 162 篇主结论附带了 Lean 形式化证明代码,剩下的数百篇正在撑爆人类学术界的同行评审系统。

在纯粹的符号逻辑和形式化推导领域,碳基人类依靠肉身演进筑起的智力防线宣告被彻底突破。我们无法阻止新纪元的开启。在“做”的门槛被彻底抹平后,“想”和“说”的门槛被无限拉高。人类正在被迫从知识的创造者,退位成欲望的发布者,以及在硅基经卷中挑拣真理的“论文清洁工”。

时代是一座大山,而在 30 天算法海啸中失去逻辑解释权的人类,皆是鸿毛。