OpenAI partage ses avancées en maths
Original : Sharing AI progress in mathematics
Pourquoi c'est important
Les maths restent le test de référence pour évaluer le raisonnement des IA.
OpenAI publie un bilan de ses progrès en mathématiques, domaine où ses modèles atteignent des niveaux de performance inédits face à des problèmes formels et olympiques.
OpenAI franchit une nouvelle étape dans l'application de l'IA aux mathématiques. La publication, diffusée sur le site officiel d'OpenAI, vise à documenter les progrès récents de ses modèles sur des tâches mathématiques avancées — qu'il s'agisse de raisonnement formel, de démonstration de théorèmes ou de résolution de problèmes de type olympiade. Ce domaine est devenu un banc d'essai privilégié pour mesurer les capacités de raisonnement pur des grands modèles de langage, au-delà de la simple mémorisation. Des systèmes comme o1 et o3 ont déjà montré des performances remarquables sur des compétitions telles que l'AMC, l'AIME ou l'IMO. OpenAI rejoint ainsi DeepMind et d'autres laboratoires dans une course où les mathématiques servent de baromètre pour évaluer l'intelligence générale. Aucun chiffre précis ni citation officielle n'est disponible dans l'article source.