OpenAI称内部模型一个月解出100多道数学难题,同时成立数学顾问组
OpenAI表示该内部模型在约一个月训练后解决了数学多领域100多个长期未解问题,并称还包括霍奇猜想;但具体题目、解题方法和结果意义均未公开。公司同时宣布成立独立数学顾问组,但明确该组不负责建议其研究节奏。
AI解读:OpenAI说,一个内部模型在约一个月训练后解决了数学多个领域的100多个长期未解问题,并称还包括第二个千禧年大奖难题——霍奇猜想。这些说法目前只有公司自己的声明,具体解了哪些题、怎么解、结果在数学上意味着什么,都还没有公开。
这件事发生在数学家公开批评OpenAI的背景下。25位菲尔兹奖得主等人发公开信,反对用“解出多少未解难题”衡量AI在数学上的表现,认为这可能损害对概念的理解。OpenAI的回应是资助成立一个数学与人工智能顾问组,设在高等研究院。
顾问组的定位有些微妙:成员可以主动提建议、公开谈论OpenAI对数学的影响、发布自己的建议,OpenAI不付报酬,成员还能决定谁加入。但公司写明,顾问组不负责建议它“以多快速度”推进内部数学研究——也就是说,结果怎么分享可以听意见,做不做、做多快仍由OpenAI决定。
菲尔兹奖得主蒂莫西·高尔斯是创始成员之一,但他没有签署那封公开信。他担心的不是AI解题本身,而是数学的社会结构:如果“解出著名未解问题”这个梦想被AI拿走,可能有人不再愿意读博士、成为数学传统的守护者。他还提到,政策制定者可能因此认为人类数学家是多余的。
OpenAI表示,一个内部模型在约一个月训练后解决了数学大多数领域的100多个长期未解问题,并称其中包括第二个千禧年大奖难题——霍奇猜想。公司是在宣布成立一个新数学顾问组时披露这一说法的。
据OpenAI称,训练于8月28日启动,整个运行约一个月。公司自己的数学家也对进展速度感到“惊讶”,内部讨论已转向如何给学术界足够预警。
哪些问题被解出、模型如何解题、这些结果对数学和科学意味着什么,目前仍是未解问题。已发布的纳维-斯托克斯方程解已在部分科学界引发激烈争论。
顾问组设在高等研究院,但不能建议研究节奏
OpenAI表示正与数学家合作,这些数学家组建了数学与人工智能顾问组,设在高等研究院。该组旨在连接公司与数学界及更广泛的公众。OpenAI称这一合作是“第一步”,前方还有“关于AI如何支持数学理解、以及这些能力的好处如何触达更广泛社区的难题”。
OpenAI称该组将独立运作。成员可以主动提出建议,公开谈论公司对数学的影响,并发布自己的建议。OpenAI不向他们支付报酬,成员可以决定谁加入该组。
但该组不被允许控制OpenAI推进的速度。公司写道:“重要的是,该组不负责建议我们如何安排内部数学研究的节奏。”该组对结果如何分享有发言权,但对是否产出结果或产出速度没有发言权。
高尔斯加入顾问组但拒绝签署公开信
顾问组创始成员之一是著名数学家、菲尔兹奖得主蒂莫西·高尔斯。他没有签署那封由25位菲尔兹奖得主领衔的公开信,并在博客中说明理由。
高尔斯同意公开信的大部分内容,也认为数学陷入困境。分歧在于数学的目的。公开信将概念理解视为主要目标,解题只是达到目标的手段。高尔斯则看到一个谱系:“在谱系的一端,数学家的主要动机是希望解决问题,他们把概念理解视为实现该目标的重要手段。在另一端,数学家的主要动机是希望获得概念理解,他们把解决问题视为实现该目标的重要手段。”
高尔斯说,他在剑桥的自动定理证明研究项目,在大型语言模型变得足够好后失去了存在理由。“换句话说,我们不得不吞下苦涩的教训(当然我们一直知道这很可能发生,只是发生速度令我们惊讶)。”
高尔斯:真正的风险是没人再想当数学家
高尔斯说,他最担心的是维系数学知识的社会结构可能崩溃。原本可能攻读博士、成为“数学传统守护者”的人,可能干脆认为不值得。
“就我自己而言,我成为数学家的主要动力是梦想解决未解问题——越著名越好。”拿走这个梦想,不清楚什么能填补空缺。
还有经费问题。政策制定者可能看着AI驱动的数学,认为人类数学家是多余的。高尔斯写道:“我们迫切需要想出好办法,解释为什么拥有大量人类数学专家是有价值的,即使发现新定理证明不再属于他们的角色。”
他也没有签署那封公开信,因为他弄不清它要求什么尚未发生的事情。他预计,能解决重大数学问题的LLM将在几个月内公开可用。“所以我觉得,批评AI公司生成太多解答太快,没有什么好处。”