2026年9月17日到18日,哈佛大学数学科学与应用中心,24个全美最顶尖的数学家坐到了一起。 MIT的Larry Guth来了,普林斯顿的Assaf Naor来了,斯坦福的Ravi Vakil来了,伯克利的Martin Olsson和Thomas Scanlon也来了。这些人平时散落在各大高校,能在同一个屋檐下聚齐两天,本身就不寻常。 他们讨论的不是什么千年数学难题,而是一个更棘手的问题:当AI开始写论文,我们怎么判断一个博士生到底行不行? 图片 两天后,一份8页的报告挂在了哈佛CMSA的官网上。这份报告的建议,用一句话概括就是:别再用博士论文来评定博士毕业了。 听听这话,从一个数学家的嘴里说出来,是不是有点疯? 但这群人没疯。他们在一份声明里写得明明白白:“论文本身,当被孤立地使用时,已经不是一个评估学生的可靠工具。” 换句话说,一篇看起来漂漂亮亮的博士论文,可能根本就不代表坐在你面前的那个年轻人,真的搞懂了里面任何一个证明。 一、 258篇论文的幽灵 就在哈佛这场闭门会议召开的前一周,学术圈已经炸了一次锅。 图片 芝加哥大学布斯商学院,一位叫尼古拉斯·波尔森的统计学终身教授,被人扒出来在9个月里署名了超过200篇论文和14本书。哥伦比亚大学的安德鲁·盖尔曼教授专门跑去翻了波尔森的SSRN主页,发现这哥们儿不光产量惊人,而且篇篇都是长文,不少长达二三十页甚至五十多页,光8月份一个月就上传了104篇。 更离谱的是,8月26日当天,他上传了6篇。 你算算这个账。一个正常的数学或统计学研究者,一篇像样的论文从想法到定稿,少则几个月,多则几年。一年能发十来篇的已经是高产得让人眼红。波尔森一天发6篇,这不叫学术产出,这叫学术印刷机。 盖尔曼点开了其中一篇题为《人类联结理论》的论文,全文80页,横跨经济学、心理学、生物学、哲学和博弈论。看完之后他的结论是:内容缺乏实质价值,部分文字读起来像是聊天机器人生成的。 后来波尔森本人承认了,确实用了AI。他的解释倒也直白:AI让研究过程中的繁重工作变得容易,“原本具有生产力的研究人员可以大幅提高效率”。 SSRN反应很快,下架了他257篇文章,冻结了上传账号。 这事听起来像个学术界的奇闻轶事,不过如果你把它和哈佛那份报告放在一起看,就会发现这是一个巨大裂缝的两端。 一端是:AI已经可以批量生产看起来像论文的东西,而且速度快到人类审核根本追不上。另一端是:一个顶级的数学家群体已经得出结论,论文本身不再能证明什么了。 当生产端和审核端同时失效,博士学位赖以存在的根基就开始松动了。 二、博士这个东西是怎么来的 要知道这件事有多严重,得先搞清楚博士这个玩意儿到底是怎么来的。 12世纪的欧洲,工商业行会盛行,大学也照葫芦画瓢,搞起了自己的行会制度。学士、硕士、博士,本质上就是教师行会内部的等级资格认证。谁拿到了博士学位,谁就有资格单独开课收徒,有点像中世纪的“教师资格证”。 那时候的博士考试,核心环节是什么?公开辩论。你得站在台上,面对一群比你年长、比你资深的学者,用拉丁语唇枪舌剑,证明你真的吃透了知识。 真正把博士教育塑造成今天这个样子的,是19世纪初的德国人洪堡。1810年,威廉·冯·洪堡创办柏林大学,提出了一个在当时惊世骇俗的理念:教学与科研相统一。从此,博士不再只是一个“能教书的人”,而被定义为“能独立创造新知识的人”。柏林大学的哲学院开始授予哲学博士学位,强调学术自由和原创性研究,这就是现代博士生教育的起点。 洪堡模式给博士生教育注入了一个核心信念:博士的价值,在于他能不能创造出前人没有的知识。 为了证明这一点,你需要写一篇论文——一份独立完成的、包含原创贡献的学术作品。这篇论文,就是你智识成色的证明。 这个逻辑运转了两百多年。两百年里,论文就是博士的通行证,没论文就没有博士,天经地义。 问题是,洪堡当年做梦也想不到,有一天会有一台机器,能在几个小时内写出看起来像模像样的论文。洪堡假设了一个前提:能写出好论文的人,一定经过了严格的学术训练,具备独立的思考能力。 这个假设在AI时代,不成立了。 AI可以写出结构完整、引用规范、论证流畅的学术文本,然而它没有思考,没有判断,没有真正理解任何一个证明为什么成立。更麻烦的是,这些AI生成的文本和人类写的论文之间的差距,正在迅速缩小。有研究显示,在适当的提示下,AI生成的学术文章在某些方面——比如形式逻辑的严密性——甚至被评审认为优于人类作品。 洪堡模式用两百年建立起来的逻辑链条,正在被一行行代码无声地锯断。 三、那篇论文坐在椅子上 哈佛那份报告最狠的一句话,藏在推荐方案的第二段里。 报告建议,PhD候选人需要接受每年至少一次的、由多位教员参与的面对面严格评估,评估产生的报告应当成为学生未来求职档案的一部分。报告还建议借用其他学科已经通行的“研究计划书加