展开目录
#OpenAI#数学#AI治理#对齐#AI科研#深度分析

OpenAI 成立数学顾问团:解出 100+ 开放问题之后,数学界拿到的只有「建议权」

2026 年 9 月 21 日,OpenAI 在普林斯顿高等研究院(IAS)设立「数学与人工智能顾问团」,首批 9 位数学家。同批披露的内容更劲爆:8 月 28 日开始训练的那个内部模型,在解出 Navier-Stokes 千禧难题之后,又解出了 100 多个跨领域长期开放问题。但顾问团被明确排除在研究节奏之外——官方原文写明「不负责就如何安排我们内部数学研究的进度提供建议」。

预计阅读 10 分钟

一句话总结

2026 年 9 月 21 日,OpenAI 宣布在普林斯顿高等研究院(IAS)设立「数学与人工智能顾问团」(Advisory Group on Mathematics and Artificial Intelligence),首批 9 位数学家——其中 3 位是菲尔兹奖得主。官方对外的说法是「给数学界一个声音」;但同一篇公告也写明,顾问团不负责就内部数学研究进度提供建议对 OpenAI 没有决策权。而在公告的背景段落里,藏着一个更值得记住的数字:8 月 28 日开始训练的那个内部模型,已经解出 100 多个长期开放问题

数据来源:OpenAI 官方公告《Advisory Group on Mathematics and Artificial Intelligence》(openai.com,2026-09-21)、普林斯顿高等研究院(IAS)同期新闻稿、数学界公开声明《A Severe Misalignment of AI in Mathematics》(mathandai.org,2026-09-11,DOI 10.5281/zenodo.22737750)、TechCrunch 报道(2026-09-21,Aditya Mehta)。文中配图来源已逐张标注。


9 月 21 日:一份写得很克制的公告

公告本身不长,措辞也刻意温和。官方给出的定位是一句典型的机构话术:

“This group will serve as a bridge to the mathematical community and broader public, giving mathematicians a voice in how we move forward.”

OpenAI 官方「数学与人工智能顾问团」公告页

但紧接着的第二段,就是这份公告真正的分量所在:

“On August 28, we began training a new internal model. In addition to resolving the Navier–Stokes Millennium Prize problem, this model has now resolved more than 100 long-standing open problems across most areas of mathematics. The pace of its progress in mathematics has surprised the mathematicians within OpenAI.

OpenAI 官方公告正文:8 月 28 日开始训练的模型与 100+ 开放问题

连 OpenAI 内部的数学家都被这个速度惊到了」——这句自述比顾问团本身更能说明问题:公告的动机不是公关,而是内部开始担心「怎么跟数学界交代」。官方在原文里也写了,正因为进展快得超出预期,才有了内部关于「如何告知社区、好让整个领域做准备和适应」的讨论。


时间线:从「解出难题」到「成立顾问团」

把最近一个多月的节点排起来,逻辑就很清楚了:

2026-08 至 09:AI 攻数学的时间线

  • 8 月底–9 月初:那个内部模型给出 Navier-Stokes 千禧难题的「解」。关于这次攻关本身(约 10,000 个并发 Agent88 小时,再用 17 小时完成 Lean 4 形式化),我们在此前那篇《10,000 个 Agent、88 小时》里已经详细写过。
  • 9 月初25 位菲尔兹奖得主联名签署公开信,质疑 AI 实验室把「解名题」当成跑分竞赛的做法正在威胁数学家的智力工作
  • 9 月 11 日:数学界发布公开声明《A Severe Misalignment of AI in Mathematics》(mathandai.org),开放 ORCID / 学术邮箱联署。声明里那句话是整个事件的题眼:

“The push by AI companies to solve mathematical problems as a benchmark is detrimental to the science of mathematics, and to the mathematical community. The goals of the AI companies and the goals of the mathematical community are severely misaligned.

  • 9 月 21 日:OpenAI 宣布成立顾问团,并在同一篇公告里首次公开「100+ 开放问题」这个数字。

数学界公开声明《A Severe Misalignment of AI in Mathematics》(mathandai.org)

顺序很重要:不是 OpenAI 先想做个治理样板,然后才有争议;是争议先爆发,顾问团随后落地


顾问团能做什么,不能做什么

这是整件事最需要掰开看的部分。官方给顾问团划的权限边界相当明确:

顾问团的权力边界:可以做 vs 明确不做

可以做(官方与 IAS 稿件的合并口径):评估新成果的学术意义、建议如何对外发布与协调公开节奏、提出数学研究的标准建议、主动发表未被邀请的意见乃至公开批评 OpenAI自主决定成员构成,并且成员不领 OpenAI 的薪酬

明确不做:不参与决定研究进度、对公司没有决策权、不能要求公司放慢或改变研究方向。官方公告原文如下——

“the group will not be responsible for advising us on how to pace our internal progress on mathematics.”

IAS 在自己的新闻稿里把同一件事说得更直白:

“Although we will give advice, we do not have decision making power at any AI company, and the responsibility for the decisions made by any company will rest with that company.”

换句话说:顾问团拿到的是「公开说话的权利」和「不被过滤的批评权」,但没有拿到「让研究慢下来」的任何杠杆。 这正好对着数学界那封公开信的核心诉求——学者们要的不是被咨询,是节奏被约束。TechCrunch 的概括很准:「成员不被支付薪水,但可以提出未被邀请的建议、公开自己的观点、控制自己的成员构成,从而获得了一定程度的独立性」——注意「一定程度的」这个限定


首批 9 位成员

名单本身的质量说明 OpenAI 是认真想找人说上话的——3 位菲尔兹奖得主在列:

首批 9 位成员(顾问团由普林斯顿高等研究院 IAS 主办)

成员机构
François CharlesENS-PSL
Camillo De LellisIAS / GSSI
Timothy Gowers(菲尔兹奖)Collège de France / Cambridge
Martin Hairer(菲尔兹奖)EPFL / Imperial College London
Nikhil SrivastavaBerkeley / Simons Institute
Ulrike TillmannOxford / INI
Ravi VakilStanford
Edward Witten(菲尔兹奖)IAS
Melanie Matchett WoodHarvard

一个耐人寻味的细节:9 位首批成员里,只有 Camillo De Lellis 一人同时也签署过那封 25 位菲尔兹奖得主的联名公开信。也就是说,公开站在批评一侧的数学家里,绝大多数没有进入这个顾问团——这既可以被读成「顾问团吸纳了批评者」,也可以读成「顾问团吸纳的是相对温和的那部分人」。两种解读都成立,公告本身没有回答这个问题。


为什么这件事比「又解出 100 道题」更值得关注

第一,它暴露了 AI 科研的真正瓶颈已经不是能力,而是「信任基础设施」。 一个模型解出 100 多个开放问题,本该是学界盛事;实际结果是先出一封抗议联名信、再出一份「严重错位」的公开声明、最后才出现一个只有建议权的顾问团。成果的说服力,卡在了「谁来判断这些结果值不值得信、该以什么顺序公布」上——这恰恰是学术共同体原本自带的功能,现在不得不临时搭一个跨机构组织来补。

第二,把「治理」和「节奏」拆开,是这次安排最精巧也最可疑的地方。 顾问团被授予了「评估意义、协调发布、公开批评」的权力,却被明确免除了「讨论研究节奏」的职责。用工程语言说:他们能 review 输出,不能碰 throughput。对一家正在加速的公司来说,这是把最不会伤及自身速度的那部分透明度让出去,同时把**真正敏感的那部分(要不要慢一点)**留在内部。

第三,对普通使用者来说,这件事改变的不是工具,而是预期。 你大概率不会因为一个数学顾问团而换掉手上的模型;但这批公告连在一起,说明前沿实验室已经在为「能力增速超出社会消化能力」这件事做准备了。Anthropic 那边用的是「pacing the frontier」——把放慢写进公司叙事;OpenAI 这边用的是「成立顾问团」——把外部声音请进来,但不交钥匙。两家承认了同一个问题的存在,给出的解法却差别明显。

第四,值得警惕的反面:顾问团里有三位菲尔兹奖得主、可以公开批评、成员自决——这些都很好,但它同时意味着外界更容易把「有顾问团」当成「有治理」。IAS 自己的措辞已经把责任撇清了:决策与责任都在公司一侧。所以真正该被追踪的问题不是「顾问团成立了没有」,而是接下来一年里,它有没有公开过一次让 OpenAI 不舒服的意见


数据来源

  • OpenAI 官方公告《Advisory Group on Mathematics and Artificial Intelligence》(openai.com,2026-09-21):顾问团定位、8 月 28 日起训练的内部模型与 100+ 开放问题、「不负责建议内部研究节奏」的原文表述、成员名单与机构。
  • 普林斯顿高等研究院(IAS)同期新闻稿:顾问团主办方身份、成员名单、「我们不拥有任何 AI 公司的决策权」的原文表述。
  • 数学界公开声明《A Severe Misalignment of AI in Mathematics》(mathandai.org,发布 2026-09-11,DOI 10.5281/zenodo.22737750):公开信发起方立场与声明正文引文。
  • TechCrunch:《OpenAI forms math advisory group as its AI resolves more than 100 open problems》(2026-09-21 13:15 PDT,Aditya Mehta):25 位菲尔兹奖得主联名信、「只有 Camillo De Lellis 同时签过该信」、顾问团权力边界的第三方转述。
  • 本站此前报道:《10,000 个 Agent、88 小时:OpenAI 用 AI 攻下了 Navier-Stokes 千禧难题》
  • 配图来源:math-advisory-group-official.pngmath-advisory-page.png 为 OpenAI 官方公告页真实截图;mathandai-site.png 为数学界声明站 mathandai.org 真实截图;openai-math-advisory-group-2026.png(封面)、openai-math-timeline-2026.pngopenai-math-group-powers-2026.pngopenai-math-members-2026.png 为本站依据上述一手材料自制的示意图。

Related

相关文章

延伸阅读

查看全部 →
OpenAI

90 分钟的双雄对决:GPT-6 Sol/Luna 与 Opus 5.5 同日发布,API 价格集体腰斩

2026 年 9 月 22 日,Anthropic 发布 Claude Opus 5.5(Fable 5.1 级性能、综合成本比 Opus 5 低 40%、输出 $20/百万 token),90 分钟后 OpenAI 发布 GPT-6 Sol 与 Luna,把 API 价格砍到上一代的一半(Sol $2/$10、Luna $0.10/$0.50)。两家在同一个方向用力:不是更聪明,而是更便宜。

Grok

Grok 4.7 发布:智能只涨 2 分,思考量翻了 2.5 倍,单任务成本翻倍到 $3.74

SpaceXAI 于 9 月 21 日发布 Grok 4.7,官方称「相比 Grok 4.6 显著提升,价格与速度相同」。但 Artificial Analysis 的独立评测给出了另一半事实:智能指数 46 分(4.6 是 44),速度却从 60.4 掉到 38.8 token/秒,评测中生成的 token 从 94M 涨到 240M,每个任务的成本从 $1.86 翻到 $3.74。同一天,小米把同分位的开源模型以约 1/20 的价格开了出来。

小米

小米开源 MiMo-V2.6:6 天 30 步 RL 全程直播,347 万美元「养」出最强开源模型

2026 年 9 月 22 日,小米开源 MiMo-V2.6 系列:Pro 版在 Artificial Analysis 智能指数拿到 46.32 分,超过 Kimi K3 和 Qwen3.8 Max,成为迄今最强开源模型,而 API 定价与 V2.5 完全持平。更少见的是训练过程全程直播——6 天 30 步 RL、各约 75 万条轨迹、合计约 347 万美元,连 GPU OOM、网络中断、数据集坏 pattern 都被写进了公开的 notices 里。