IA

OpenAI publie 722 manuscrits de résultats en mathématiques générés par un modèle non divulgué

Un groupe consultatif indépendant indique que cette publication comprend des solutions à des centaines de questions ouvertes.

OpenAI a publié un ensemble de 722 manuscrits contenant des solutions à des problèmes mathématiques anciens, produits par un modèle de pointe non encore rendu public. Les manuscrits couvrent 372 familles de résultats qui regroupent des articles liés, selon theverge.com.

L'Advisory Group on Mathematics and Artificial Intelligence (AGMAI) a déclaré que cette publication comprend des solutions à des centaines de questions ouvertes. Les documents mis en ligne comportent des résumés du raisonnement du modèle, des estimations de la puissance de calcul utilisée et des statistiques sur le nombre de problèmes abordés.

OpenAI affirme que le résultat moyen a mobilisé l'équivalent de trois heures de réflexion de ChatGPT Pro. La publication a été effectuée dans un dépôt GitHub, accompagnée de protocoles pour la révision des articles et les citations.

Selon OpenAI, d'autres alternatives hébergées par la communauté, conformes aux lignes directrices du comité, restent à l'étude pour cette publication.

Contexte

En septembre 2025, OpenAI avait indiqué que son modèle avait résolu plus de 100 problèmes ouverts anciens dans la plupart des domaines des mathématiques. Fin septembre 2025, AGMAI avait publié ses premières recommandations, appelant les laboratoires d'IA à diffuser rapidement les résultats mathématiques par les canaux académiques établis, à divulguer les noms des modèles, les invites et les coûts de calcul, et à ne pas traiter la publication de résultats mathématiques comme un outil marketing pour promouvoir leurs modèles.

En bref

Qu'a publié OpenAI ?

Un ensemble de 722 manuscrits contenant des solutions à des problèmes mathématiques anciens, produits par un modèle de pointe non encore rendu public.

Où ces résultats sont-ils disponibles ?

Dans un dépôt GitHub publié par OpenAI, avec des protocoles pour la révision des articles et les citations.

Quelle puissance de calcul a été utilisée ?

OpenAI indique que le résultat moyen a représenté l'équivalent de trois heures de réflexion de ChatGPT Pro.

Source