AI

OpenAIの数学問題解答、AGMAI基準に届かず

OpenAIが数学の難問に対する数百件の解答を公開したが、数学者グループの基準、特に人間による理解の必要性を満たしていないと批判されている。

OpenAIは今週、数学の難問に対する数百件もの解答を公開した。しかし、数学者たちからは、人間による理解と形式化に関する基準を満たしていないとの批判が上がっている。

OpenAIは、以前のモデルが長年の未解決問題を解いた際の論争を避けるため、エリート数学者の諮問グループに相談したと述べている。しかし、数学・人工知能諮問グループ(AGMAI)の基準、特に数学的結果を人間が理解することの必要性については、その基準に達していない。

OpenAIが公開した719件の原稿のうち、モデルの思考連鎖(chain of thought)が含まれていたのはわずか10件だった。AGMAIの最初の要請は、独自モデルで高度な数学問題のテストを中止することだった。

OpenAIのリリースには、数学の未解決研究問題を用いて独自モデルを評価していると明記されている。ケンブリッジ大学とキングス・カレッジ・ロンドンの数学者による新しい論文では、Navier-Stokes方程式から派生した問題に対するOpenAIの解答について、自然言語による証明と背後にあるLeanコードの間に少なくとも2つの不一致があることが記録されている。

Terence Taoはソーシャルメディア上で、AIの出力を十分に理解していないAIプロンプターによって問題が自律的に解かれており、質問に答えたり、講演を行ったり、分野と交流したりするのに十分な理解がないと指摘した。TechCrunchが報じた。

背景

2025年9月下旬、数学・人工知能諮問グループは、数学問題を解くフロンティアラボ向けのガイドラインを発表した。OpenAIは以前、同社のモデルの1つがこの分野の長年の問題を解いたことで論争に直面した。

出典