OpenAI发布数百份数学题解 未达AGMAI标准遭质疑
OpenAI本周发布数百份高难数学题解,但仅10份附带思维链,未满足数学与人工智能咨询组对人工理解的要求。
据TechCrunch报道,OpenAI本周发布了数百份针对高难度数学问题的解答,但未能达到数学与人工智能咨询组(AGMAI)制定的标准,尤其在数学结果需要人类理解这一要求上存在明显不足。
OpenAI表示,为避免重蹈此前模型解决长期难题所引发的争议,公司此次咨询了一个由顶尖数学家组成的顾问小组。然而,AGMAI认为OpenAI的做法仍未达标。AGMAI提出的首项要求,是停止在专有模型上测试高等数学问题。
在OpenAI发布的719份文稿中,仅有10份包含了模型的思维链。OpenAI的发布说明中则明确写道,公司正在使用数学领域的开放研究问题来评估其专有模型。
剑桥大学与伦敦国王学院数学家的新论文记录了至少两处不一致:在OpenAI针对一个源自Navier-Stokes方程的问题所给出的解答中,自然语言证明与Lean代码之间存在差异。
数学家Terence Tao在社交媒体上写道,如今问题正由那些并不理解AI输出内容的AI提示者自主解决,他们无法回答问题、进行演讲,也无法与数学领域互动。
背景
2025年9月下旬,数学与人工智能咨询组发布了针对前沿实验室解决数学问题的指导方针。此前,OpenAI曾因其模型解决了一个长期存在的数学难题而陷入争议。
快速问答
OpenAI发布了多少份数学题解?
OpenAI本周发布了719份文稿,其中仅10份包含模型的思维链。
AGMAI对OpenAI提出了什么要求?
AGMAI的首项要求是停止在专有模型上测试高等数学问题,并强调数学结果需具备人类理解。
剑桥大学与伦敦国王学院的论文指出了什么问题?
论文记录了至少两处不一致:OpenAI针对Navier-Stokes方程衍生问题的解答中,自然语言证明与Lean代码存在差异。