IA

OpenAI publie 719 solutions mathématiques et essuie les critiques

L'AGMAI estime que la publication d'OpenAI ne répond pas à ses exigences, notamment sur la compréhension humaine des résultats mathématiques.

OpenAI a publié cette semaine des centaines de solutions à des problèmes mathématiques difficiles, a rapporté TechCrunch, ce qui a suscité les critiques de mathématiciens qui estiment que ces travaux ne répondent pas à leurs standards de compréhension humaine et de formalisation.

OpenAI a indiqué avoir consulté un groupe consultatif de mathématiciens de premier plan pour éviter la controverse provoquée par un précédent modèle ayant résolu un problème ancien. Selon l'AGMAI, le groupe consultatif en question, la publication d'OpenAI reste en deçà de ses exigences, en particulier sur la nécessité d'une compréhension humaine des résultats mathématiques.

Sur les 719 manuscrits publiés par OpenAI, seuls 10 incluaient la chaîne de raisonnement du modèle. La publication d'OpenAI précise explicitement qu'elle évalue ses modèles propriétaires à l'aide de problèmes de recherche ouverts en mathématiques.

Un nouvel article de mathématiciens de l'University of Cambridge et du King's College London documente au moins deux divergences entre la preuve en langage naturel et le code Lean qui sous-tend la solution proposée par OpenAI à un problème dérivé des équations de Navier-Stokes.

Terence Tao a écrit sur les réseaux sociaux que des problèmes sont résolus de manière autonome par des personnes qui ne comprennent pas suffisamment la sortie de l'IA pour répondre à des questions, donner des exposés ou interagir avec le domaine. En septembre dernier, l'AGMAI avait publié des lignes directrices pour les laboratoires de pointe s'attaquant à des problèmes mathématiques, et sa première demande était de cesser de tester des problèmes mathématiques avancés sur des modèles propriétaires.

En bref

Combien de solutions OpenAI a-t-il publiées ?

OpenAI a publié 719 manuscrits, dont 10 seulement incluaient la chaîne de raisonnement du modèle.

Pourquoi les mathématiciens critiquent-ils cette publication ?

L'AGMAI estime qu'OpenAI n'a pas atteint ses standards, notamment sur la nécessité d'une compréhension humaine des résultats mathématiques.

Qu'a révélé l'article des mathématiciens ?

Des chercheurs de l'University of Cambridge et du King's College London ont documenté au moins deux divergences entre la preuve en langage naturel et le code Lean derrière la solution d'OpenAI à un problème dérivé des équations de Navier-Stokes.

Source