Trust My Science
MathématiquesTechnologie 5 min de lecture

Pour la première fois, l’IA décroche un score parfait aux Olympiades de mathématiques et égale l’élite humaine

Valisoa Rasolofo 27 juillet 2026
IA-score-parfait-olympiades-mathematiques-couv | Pixabay

Pour la première fois, l’IA a obtenu un score parfait aux prestigieuses Olympiades internationales des mathématiques (OIM), qui se sont déroulées ce mois-ci à Shanghai. Les modèles, Celia de Huawei et dots-note-3.0 de Xiaohongshu (ou RedNote), ont répondu correctement à 100 % des questions soumises aux participants humains, dont certaines comptent parmi les problèmes mathématique les plus difficiles au monde. Ces résultats constituent une étape majeure dans les performances des modèles d’IA en mathématiques.

Organisées une fois par an depuis 1959, les OIM sont mondialement reconnues comme étant la plus prestigieuse et la plus difficile compétition de mathématiques pour les élèves du secondaire. Organisées chaque année dans une ville ou un pays différents, elles réunissent plus de 100 pays et réunissent exclusivement des élèves de moins de 20 ans.

Les participants ont deux jours pour résoudre six problèmes mathématiques extrêmement complexes couvrant l’algèbre avancée, la géométrie, la théorie des nombres et la combinatoire, chacun valant sept points. Contrairement aux examens conventionnels où une réponse finale standard suffit, les tests soumis lors des OIM nécessitent des démonstrations rigoureuses, innovantes et détaillées. Toute erreur de raisonnement ou toute hypothèse non vérifiable entraîne une perte de points.

Cette année, 666 participants provenant de 120 pays se sont présentés au concours et la note nécessaire pour obtenir une médaille d’or était de 29 points. D’après le tableau officiel des scores des OIM, seuls sept participants sur 666 ont obtenu un score parfait de 42 points, tandis que 55 ont obtenu des médailles d’or.

Quand la machine rejoint l’élite des mathématiques

Mais alors que les modèles d’IA participant aux concours ne pouvaient au mieux jusqu’ici obtenir que la médaille d’or, deux modèles de pointe ont pour la première fois égalé les meilleurs compétiteurs humains en obtenant un score parfait. L’exploit a été réalisé par deux modèles développés par deux entreprises technologiques chinoises : Huawei et Xiaohongshu.

« Nous sommes ravis de ce résultat, car obtenir un score parfait aux OIM est extrêmement difficile », a déclaré Xiaohongshu dans un communiqué cette semaine. « Auparavant, aucun grand modèle de langage n’avait jamais obtenu la note maximale dans le cadre du processus d’évaluation officiel de l’OIM », a ajouté l’entreprise.

Contrairement aux précédents grands modèles linguistiques qui ont participé aux OIM, les modèles chinois, en particulier dots-note-3.0, reposent sur une architecture multi-agents. Cette architecture permettrait à l’IA de débattre itérativement avec elle-même, d’étayer sa logique à chaque étape et de rassembler des preuves pertinentes sans introduire d’hallucinations, selon Streamlinefeed. Les précédents modèles, eux, s’appuyaient plutôt sur une approche par essais et erreurs.

Les modèles Celia et dots-note-3.0 n’ont reçu les problèmes à traiter lors des OIM qu’après le début de la compétition pour les participants humains. Ils ont traité les problèmes selon des protocoles d’isolation stricts et vérifiables, supervisés par les organisateurs du concours.

Les deux modèles ont généré des démonstrations mathématiques parfaitement exemptes d’erreurs, franchissant le seuil de 29 points et obtenant un score total de 42 points. À titre de comparaison, Gemini Deep Think de Google DeepMind, le médaillé d’or de l’année dernière, avait obtenu un score maximal de 35 points.

Les constructeurs de Celia et de dots-note-3.0 affirment également que leurs systèmes effectuent les calculs complexes exigés lors des OIM avec nettement moins de ressources que les modèles précédents. Cela suggère que les modèles disposant de capacités de raisonnement mathématique de haut niveau pourraient bientôt être déployés à grande échelle.

Au-delà de la performance, des enjeux économiques

Alors que l’IA est déjà en train de transformer l’économie mondiale, cette avancée dans leur capacité de raisonnement pourrait bouleverser davantage les paradigmes éducatifs et économiques. En effet, cette capacité pourrait bientôt, en théorie, leur permettre d’être appliqués à des problèmes complexes comme l’analyse de protocoles cryptographiques ou la découverte de nouvelles molécules.

Cette avancée souligne en outre l’accélération du développement des technologies d’IA. En effet, si seuls Huawei et Xiaohongshu ont pour le moment annoncé avoir atteint un niveau comparable à celui des meilleurs participants de cette édition, d’autres annonces d’entreprises concurrentes pourraient ne pas tarder à venir.

Deedy Das, associé de la société d’investissement américaine Menlo Ventures, a par exemple déclaré avoir confié les questions des OIM de cette année à quatre modèles d’IA de pointe développés par OpenAI, Anthropic, Axiom Math et MoonshotAI. Il a affirmé que tous quatre sont parvenus à obtenir un score parfait. Cette affirmation repose sur sa déclaration et n’a pas fait l’objet d’une validation indépendante. « La frontière de l’IA a officiellement largement dépassé les mathématiques de l’OMI », a-t-il écrit dans une publication LinkedIn.

Similaire

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *