오픈AI, 수학 난제 해법 719건 공개…수학자들 기준 미달 지적
오픈AI가 공개한 719건의 수학 난제 해법 가운데 10건만 사고 과정을 포함해, 수학자 자문 그룹의 기준에 미달했다는 지적이 나왔다.
오픈AI가 이번 주 수백 건의 수학 난제 해법을 공개했지만, 수학자들은 인간의 이해와 형식화 기준을 충족하지 못했다고 비판했다. 오픈AI는 이전 모델이 오래된 난제를 해결해 논란을 빚은 뒤, 엘리트 수학자 자문 그룹의 자문을 받았다고 밝혔다.
그러나 오픈AI는 수학·인공지능 자문 그룹(AGMAI)의 기준, 특히 수학적 결과에 대한 인간의 이해 필요성에서 기준에 미달했다. 오픈AI가 공개한 719건의 원고 가운데 모델의 사고 과정을 포함한 것은 10건에 불과했다.
AGMAI 기준과 형식화 불일치
AGMAI의 첫 요청은 독점 모델로 고급 수학 문제를 테스트하는 것을 중단하라는 것이었다. 오픈AI의 발표문은 독점 모델을 수학의 공개 연구 문제로 평가하고 있다고 명시했다.
케임브리지대와 킹스칼리지런던의 수학자들이 작성한 새 논문은 나비에-스토크스 방정식에서 파생된 문제에 대한 오픈AI의 해법에서 자연어 증명과 Lean 코드 사이에 최소 두 건의 불일치가 있음을 기록했다.
테렌스 타오는 소셜 미디어에서 AI 출력을 충분히 이해하지 못하는 AI 프롬프터들이 문제를 자율적으로 해결하고 있으며, 이들은 질문에 답하거나 강연을 하거나 학계와 상호작용하기 어렵다고 썼다.
지난 9월 말 AGMAI는 수학 문제를 해결하는 프런티어 연구소를 위한 지침을 발표했다.
한눈에 보기
오픈AI가 공개한 수학 난제 해법은 몇 건인가?
오픈AI가 이번 주 공개한 수학 난제 해법은 수백 건이며, 그중 719건의 원고 가운데 모델의 사고 과정을 포함한 것은 10건이다.
수학자들은 왜 비판했나?
오픈AI가 수학·인공지능 자문 그룹(AGMAI)의 기준, 특히 수학적 결과에 대한 인간의 이해 필요성에서 기준에 미달했기 때문이다.
나비에-스토크스 방정식 문제 해법에서 어떤 문제가 발견됐나?
케임브리지대와 킹스칼리지런던 수학자들의 새 논문은 자연어 증명과 Lean 코드 사이에 최소 두 건의 불일치가 있음을 기록했다.