DEV Community

cognitalk
cognitalk

Posted on

Terrence Tao PK OpenAI,Math-AI Developing Forecast

1.OpenAI无视此前协定一次性发布七百多篇AI数学证明文件,陶哲轩‘宣战’OpenAI

  1. 事件核心:菲尔兹奖得主陶哲轩领导的“人类数学协会”(AHM)发布联合声明,公开抵制OpenAI。

  2. 导火索:OpenAI无视此前与数学家组成的咨询小组达成的“不应擅自用内部模型测试高深数学难题”的共识,一次性发布了700多篇由AI生成的数学证明文件。

  3. 数学家愤怒的原因:

    • 算力霸权:AI用极低成本(平均3小时算力)解决了学者需要数年才能完成的研究,是对人类智力劳动的蔑视。
    • 质量低劣:这些AI生成的证明逻辑混乱、晦涩难懂(被形容为“外星人般的疯狂逻辑”),缺乏可读性和严谨性,迫使人类数学家成为免费的“验题工具人”。
    • 学术污染:问题被AI“宣称解决”后,会污染原有的研究方向,扼杀可能产生更深刻洞见的传统研究路径。
  4. 不同观点:

    • 陶哲轩等抵制派:认为AI的野蛮发展正在摧毁数学的本质,导致“证明消化不良”,并呼吁数学家停止与OpenAI合作。
    • 杨立昆(图灵奖得主):持乐观态度,认为这标志着数学进入新时代,形式证明将被自动化,人类应转而专注于发展新概念、新猜想。

一句话总结:数学界领袖陶哲轩联合众多数学家,因OpenAI大规模发布低质且不可读的AI生成证明,破坏了学术规范和科研生态,正式发起全面抵制。

2.未来数学发展的争斗可能会是怎样的?

这场争斗大概率不会以“某一方彻底胜利”收场,而是会把数学界的生产关系重新切一刀:OpenAI 不会撤回已经发布的 722 篇(现已 719 篇),AHM 的“抵制”也很难变成全行业硬性禁令,但数学共同体一定会把验收门槛和功劳分配规则改写掉。下面按时间尺度拆开看。

短期(3–12 个月):表面僵局,暗地分流

OpenAI 这边不会退

  • 官方口径已经定了:这是“广泛数学结果”的发布,配 Lean 形式化、给 10 份推理摘要、承诺办 workshop 和会议 。
  • 仓库修订记录还在更新,撤了 3 篇(Weil 类符号错误连带 K3 曲面两篇),剩 719 篇,说明他们选择“边发边修”,不是“收回重来” 。
  • 模型不公开、prompt 不公开、Issues 关闭——这三个动作基本宣告 OpenAI 不会退回到“先过同行评审再发”的老路。

数学界这边也不会真“联合抵死”

  • AHM 声明本身没有制裁机制,“boycott”是媒体词;陶哲轩是以客座转发形式挂博客,不是以个人名义宣战 。
  • 25 位菲尔兹奖得主此前联署的是“反对节奏、反对抢发”,不是“反对 AI 做数学” 。
  • 年轻学者嘴上抵制、手上会偷偷用——尤其 Lean 形式化部分,本身就是可复跑的硬货。

所以这阶段的实际画面是:

OpenAI 继续倾泻 → 顶尖数学家挑其中“能懂、能引用、能拿来讲课”的少数结果吸收 → 大部分 719 篇在 GitHub 上躺着等人验 → 验证负担转嫁给无酬学术界。

中期(1–3 年):规则会被重写成“Math 2.0”

陶哲轩提的“Math 2.0”不是情怀,是一套新的信用分配方案,大概率会落地成几条硬规矩 :

  1. 优先级不再归“第一个出 AI 预印本/Lean 绿勾的人”,而归“第一个给出可读论文 + 形式化证书 + 公开阐释包”的团队。
  2. 期刊和会议会强制披露:用了哪个模型、prompt 是什么、算力多少、Lean 版本、独立内核复跑记录。
  3. Lean 绿勾≠录用。形式化只证明“代码自洽”,不证明“题面翻译忠实于原猜想”——这一层(representational fidelity)必须人类专家签字 。
  4. “作者”栏会出现新格式:模型名 + 人类阐释者 + 验证人分列,而不是把 AI 输出包装成某人独著。

AGMAI 已经把底色调成“发布只是开始,不是结束”,而且强调数学家必须能提自己的问题、探索 AI 没选的方向 ——这句会被写进未来期刊指南里。

长期(3–10 年):数学家的角色从“解题者”变“仲裁者+提问者”

杨立昆那套“船取代游泳但发现新大陆”和陶哲轩“Math 2.0”其实不矛盾,只是站在不同楼层:

  • 底层解题:AI 承包。开放题批量刷,形式化证明自动化。
  • 中层 adjudication(裁决):人类稀缺资源。题面翻译对不对、这个结果在学科里意味着什么、和哪条旧理论冲突——这几件事机器做不了,因为需要“理解意图”和“判断意义” 。
  • 顶层提问与开荒:人类保留。AI 不会主动说“我想知道为什么 π 的无理性指数是 2 这件事能不能反过来启发 L 函数”,这是人的活。

所以结果不是“数学家失业”,而是数学家的溢价从‘算得快’转移到‘看得懂、讲得清、定方向’。验题员会更累,但能开新方向的人会更贵。

几种可能情景的概率判断

情景 可能性 关键条件
OpenAI 继续批量倾泻,数学界半推半就吸收 高 只要 Lean 形式化比例继续抬升、少数结果被大家引用
顶级期刊联合拒收“无人类阐释包”的 AI 预印本 中高 莱顿宣言 + AGMAI 准则固化成投稿规则
AHM 式硬抵制引发分裂,部分数学家彻底不碰 OpenAI 成果 中 取决于接下来 1–2 年有没有重大错证事件
出现“AI 证明 + 人类阐释”双作者强制规范 中高 陶哲轩优先级规则被 IMU 或 Annals 级刊物采纳
密码学/千禧难题被 AI 真拿下引发外部监管介入 低但存在 若出现可攻击 RSA/ECC 的数学捷径,争论会溢出数学圈

一句判断收口

这场架的终局不是“人类数学战胜 AI”或“AI 埋葬数学”,而是:

OpenAI 拿到了“生成权”,但解释权、收录权、教学权、诺奖/菲尔兹归属权还是留在人类手里。

谁先把“AI 出结果 → 人类出理解”的流水线制度化,谁就定义了下一代数学。

Top comments (0)