Le mathématicien Terence Tao, médaillé Fields et voix influente sur les usages de l'IA en recherche mathématique, a publié un billet intitulé « A severe misalignment of AI in mathematics », dans lequel il pointe ce qu'il décrit comme un décalage préoccupant entre les annonces d'OpenAI et la réalité de la pratique mathématique. Le même jour, The Economist a publié un article titré « Top mathematicians are outraged by OpenAI's methods », suggérant que ce malaise dépasse le cas isolé de Tao et concerne une partie significative de la communauté.
Le contexte de cette controverse s'inscrit dans la suite des annonces faites par OpenAI depuis 2025 concernant les performances de ses modèles de raisonnement sur des problèmes de haut niveau, notamment des résultats revendiqués au niveau des Olympiades internationales de mathématiques ou sur des problèmes de recherche non résolus. Ces annonces avaient déjà suscité des débats sur la manière dont les capacités des systèmes d'IA sont mesurées, vérifiées et communiquées au public, en dehors des canaux habituels de validation par les pairs propres aux mathématiques.
Sans détail exhaustif encore disponible sur le contenu précis des griefs, les titres des deux publications laissent entrevoir une critique portant sur la méthodologie employée par OpenAI pour établir ou présenter ses résultats mathématiques, plutôt que sur les capacités techniques des modèles eux-mêmes. Ce type de dispute touche à des questions sensibles pour la discipline : la traçabilité des preuves, la distinction entre résolution automatisée et compréhension véritable, et le risque de contamination des jeux de données utilisés pour l'entraînement par des énoncés de compétition.
L'affaire illustre une tension plus large entre les laboratoires d'IA, pressés de démontrer des avancées spectaculaires, et une communauté scientifique attachée à des standards de vérification stricts. Que la critique vienne d'une figure aussi reconnue que Terence Tao lui confère un poids particulier, susceptible d'influencer la manière dont les futures annonces de performances mathématiques par les grands laboratoires seront reçues et scrutées.