AREX Feed Article
25 位菲尔兹奖得主联署公开信,指 AI 实验室竞速解题损害数学研究
9 月 11 日,一封由 25 位菲尔兹奖得主联署的公开信《A Severe Misalignment of AI in Mathematics》(直译:AI 在数学中的严重错位)对外发布。信中批评 AI 公司把「解出著名数学难题」当作基准来推动研发,结果往往是仓促公布、正式撰写与先期引用缺位;署名者认为,这会损害数学这门科学和数学共同体。
据 ,AI 实验室正试图用著名难题的解答互相抢先,报道把这封信放在 OpenAI 与数学家群体持续升级的争执中叙述。这封信发布在 。
从 Deligne 到 Yu Deng:联署名单横跨近半个世纪
mathandai.org 在名单里为每位署名者标注了菲尔兹奖获奖年份,从 1978 年获奖的 Pierre Deligne 到 2026 年获奖的 Yu Deng;名单中还有 1998 年的 Maxim Kontsevich、2006 年的 Terence Tao、2010 年的 Cédric Villani、2018 年的 Peter Scholze、2022 年的 Maryna Viazovska 等人。网站还开放公众联署,支持者经 ORCID 登录或确认学术邮箱后即可加入;显示,截至 9 月 12 日已有 2,379 名联署者。
从署名与抄袭问题,到「对智识工作的一种普遍威胁」
信开头的判断是:AI 公司把解出数学问题当作基准来推动,对数学这门科学和数学共同体有害;「AI 公司的目标与数学共同体的目标严重错位」。随后是三个具体问题——「很多这类解答被仓促宣布,来不及做正式的撰写、来不及把新方法和新思想分离出来,也来不及引用他人相关的先前工作」;信中写道,这「如同所有创造性职业一样,带来了严重的署名与抄袭问题」。
信还把问题推向更远处:如果没有愿意投入的数学家去照料这些想法的发展、把它们整合进数学经典,「AI 构想出的思想就永远不会真正活起来,数学家之间那条关键的人类传承链也将断裂」。由此引出总括:「我们正在目睹对智识工作的一种普遍威胁:AI 的使用结果与其初衷之间的错位。」
信也承认 AI「有潜力增强并加速真正的数学研究与理解」,并称数学职业需要作出适应;但它强调,「解题只是实现主要目标的工具和代理指标」,主要目标是概念性理解与洞察。以越来越快的速度批量生产「真/假」命题,「可能摧毁沃土,而不是给新思想注入生命」。
信中没有点名任何公司,只以「AI 公司」这类泛称指代。它提出的要求是:这些问题必须紧急得到处理——在数学共同体内部、在开发这些技术的公司那里,以及在更广泛的社会层面。
一周写成:Tao 说没时间像《莱顿宣言》那样充分协商
署名者之一、2006 年菲尔兹奖得主 Terence Tao 在里说明了成文过程:这封信「出自我们过去一周的讨论」;「遗憾的是,我们没有时间像《莱顿宣言》那样进行更充分的协商;但我们判断形势紧迫,需要尽早发布声明。」他说,与 6 月发布的 一样,这封信也欢迎更多签名;后者由一批数学家组成的工作组起草,为数学家个人、机构、政府与产业列出了建议。
信发布前的一周:Navier–Stokes 证明之争与 Caltech Mathathon 赞助撤回
这一周,这场争执接连升级。9 月 8 日,,称其内部系统给出了流体力学中 Navier–Stokes 方程存在性与光滑性问题的解答——七个千禧年大奖难题之一,克雷数学研究所(Clay Mathematics Institute)为每题悬赏 100 万美元——并公开了证明文稿与 Lean 形式化证明。OpenAI 称,产出解答的小组涉及约 1 万个并发 agent(智能体),结果在 9 月 5 日得出,距首批 agent 启动约 88 小时;公司不打算为这一结果申领千禧年大奖。
这则公告还牵涉另外两位数学家:纽约大学(NYU)的 Tristan Buckmaster 与供职于 Anthropic 的 Levent Alpöge。他们本周公开了三项结果。称,Buckmaster 指控 OpenAI 施压,要求他不要为这位 Anthropic 合作者署名,并质疑 OpenAI 的做法是否建立在两人未公开的工作之上;他还担心自己大量使用的 Codex 会话可能进入了 OpenAI 的模型。OpenAI 回应称,研究者与 agent 在对方公开发表之前没有看到他们的工作,解题过程「没有访问任何具体的用户数据」;但「不能排除」来自对方使用其产品的去标识化数据帮助改进了模型。TechCrunch 还称,这轮为期一周的尝试消耗约 3,000 亿个输出 token(词元),按当时的费率折算约合 2,250 万美元算力。
同样在这一周,一群 Caltech 现任与前任数学家发布,反对定于 10 月 30 日开始的 Caltech Mathathon(数学黑客松):参赛队伍要在 40 小时内用 LLM 解公开研究问题,OpenAI 与 Anthropic 承诺提供合计 200 万美元算力额度。信中把这类活动可能催生的产出称为「slop mathematics」(粗劣速成的数学产出),并称这会让数学家承担无偿的核查劳动;信里还直言 AI 公司「正在从事学术不端行为」,呼吁叫停活动。这封公开信发布时的联署人数为 771 人。9 月 10 日,OpenAI 研究负责人 Dan Roberts 表示公司将撤回赞助;,「我们不认为这会给活动带来实质影响」,并称正与其他愿意提供类似支持的公司洽谈。
「1 bit 信号,99 bit 理解」:一条来自 X 的概括
9 月 11 日,Hugging Face 联合创始人 Thomas Wolf(@Thom_Wolf)在 分享了他从这封信中读到的要点:AI 模型「随手翻检着」解掉这些问题,只给出 1 bit 的信号,却抹掉了数学家本可从与这些问题「搏斗」中提炼出的另外 99 bit 概念性理解。他在帖中附上了这封信的地址。
尚未落定:对开放研究的担忧,与保密的激励
TechCrunch 的报道还提到,一些数学家开始疑虑自己使用 Codex 的过程会不会反过来被喂进 OpenAI 的新模型,人们真切担心开放研究的文化会受到威胁。该报道的判断是:当前沿实验室看到一条通往发现的路径,就可以花数千万美元、用 LLM 抢先于原作者拿到证明——「这种动态会激励保密」。信的结尾写道:这些变化最终有益于这个领域,还是造成破坏性后果,「将在很大程度上取决于控制这项新技术的人的决定」。TechCrunch 写道,OpenAI 的证明仍未得到验证。