GenAI Actu IA générative

722 manuscrits de maths par une IA : OpenAI a trié elle-même, sans évaluation indépendante

Le 6 octobre 2026, OpenAI a déposé sur GitHub 722 manuscrits de mathématiques produits par un modèle interne non publié. Vérification inégale, modèle inaccessible : le groupe consultatif AGMAI refuse de cautionner la démarche.

· 787 mots · Rédigé par une IA

OpenAI a publié le 6 octobre 2026 un vaste lot de résultats mathématiques générés par un modèle interne non commercialisé. Le dépôt GitHub contient 722 manuscrits, regroupés en 372 « familles » de textes apparentés. Les médias ne comptent pas tous de la même façon : Gizmodo parle de 377 résultats, là où The Verge, RuntimeWire et Unite.AI s'accordent sur 722 manuscrits et 372 familles.

Ce que contient le dépôt

Selon Unite.AI, le dépôt « openai/math » est placé sous licence Apache-2.0. Chaque famille peut regrouper un résultat principal, des arguments complémentaires, des conséquences ou des preuves alternatives, et est classée par discipline. Les domaines couverts vont de la théorie des nombres à la combinatoire, en passant par l'informatique théorique et la physique mathématique, selon RuntimeWire.

Environ 4 000 problèmes ont été soumis au modèle. OpenAI a ensuite retenu les résultats qu'elle jugeait assez significatifs. Ce tri a été fait par l'entreprise elle-même : selon RuntimeWire, l'annonce ne décrit aucune évaluation indépendante de la portée ou de l'exactitude de l'ensemble. Le résultat « moyen » a mobilisé l'équivalent d'environ trois heures de raisonnement de ChatGPT Pro. Dix résumés abrégés du raisonnement du modèle sont aussi publiés, par exemple sur l'exposant d'irrationalité de π ou sur l'isomorphisme des facteurs de groupes libres.

Gizmodo cite un article pris au hasard dans le lot, qui revendique la formule complète du terme dominant de Birch et Swinnerton-Dyer. Cette preuve ne vaudrait que pour les courbes elliptiques sur ℚ, et sous une condition précise sur le groupe de Selmer. Le journaliste précise qu'il n'est pas qualifié pour juger de la validité de ces travaux.

Une vérification inégale

De nombreux manuscrits s'accompagnent de formalisations en Lean, un langage qui permet à un ordinateur de contrôler une preuve. Pas tous. OpenAI prévient que les résultats non formalisés pourraient contenir des erreurs, promet de les corriger rapidement et d'ajouter des formalisations au fil du temps. Les révisions seront enregistrées comme de nouvelles versions, les anciennes restant consultables.

RuntimeWire souligne qu'une preuve formelle établit qu'un raisonnement tient dans un système donné, mais n'explique ni son intérêt ni sa place dans la littérature. Deux travaux sortent de la procédure habituelle : l'un sur une région sans zéro de la fonction zêta de Riemann (rédaction retouchée par un humain), l'autre sur la conjecture de Hodge pour les variétés abéliennes à multiplication complexe. Le modèle n'est pas nommé, et les requêtes utilisées pour chaque résultat ne sont pas publiées.

Le groupe AGMAI, entre dialogue et distance

Le groupe consultatif sur les mathématiques et l'IA (AGMAI) a été créé après qu'OpenAI a sollicité certains de ses membres pour un comité externe. Ils ont préféré fonder une structure indépendante, sans rémunération. Elle compte notamment Timothy Gowers, Martin Hairer et Edward Witten. Ses recommandations du 29 septembre 2026, nourries de plus de 600 réponses à une enquête, demandent des dépôts dans des archives qu'aucun laboratoire ne contrôle, la publication du nom du modèle, des requêtes, du coût de calcul, et un document sur les échecs, indique Unite.AI. Elles demandent aussi aux laboratoires de ne pas faire de ces publications un outil de promotion.

Le groupe y écrit aussi : « nous n'approuvons pas cette pratique, et nous leur demandons de cesser de tester des problèmes mathématiques avancés sur des modèles propriétaires » (traduction, Gizmodo). Or les résultats du 6 octobre viennent du même modèle interne que celui de la preuve annoncée sur Navier-Stokes. Pour Gizmodo, la recommandation n'a donc pas été suivie. Le dépôt reste de plus contrôlé par OpenAI, qui dit explorer des solutions hébergées par la communauté.

Le 6 octobre, l'AGMAI a réagi : « Rendre ce travail public est un premier pas » (traduction, AGMAI). Le groupe ajoute que son rôle consultatif ne doit être lu ni comme un jugement sur l'impact des résultats, ni comme un aval du processus d'OpenAI. Il qualifie les discussions de constructives, mais affirme qu'il revient à la communauté de juger si ses recommandations ont été suivies. Il insiste aussi sur l'accès équitable aux outils et au calcul pour que les mathématiciens puissent poser leurs propres questions.

Une porte-parole d'OpenAI, Lindsay McCallum Rémy, a répondu à Gizmodo que les conseils de l'AGMAI « ont éclairé » la façon de partager les résultats, et que l'entreprise continuera d'intégrer les retours.

Suite annoncée

Selon The Verge, ces résultats s'ajoutent à ceux d'OpenAI et de rivaux comme Anthropic, y compris autour d'un problème du Millénaire, et la communauté peine à les digérer. La manière dont les laboratoires annoncent leurs travaux et créditent les mathématiciens humains suscite un vif débat.

OpenAI dit vouloir financer ateliers, conférences et programmes spéciaux, sans montant ni calendrier. Elle affirme aussi travailler à une diffusion responsable du modèle, sans date ni conditions d'accès. Tant que ce n'est pas le cas, les résultats ne peuvent pas être reproduits de façon indépendante.

Sources

OpenAI mathématiques intelligence artificielle Lean