Pour la première fois, des modèles d'intelligence artificielle ont obtenu la note maximale aux épreuves des Olympiades internationales de mathématiques, une prouesse qui reflète l'évolution rapide des capacités des systèmes intelligents en matière de raisonnement et de résolution de problèmes mathématiques complexes.
Les deux entreprises technologiques chinoises « Huawei » et « Xiaohongshu » ont annoncé que leurs deux modèles avaient obtenu un taux de réussite de 100 % aux épreuves de l’édition 2026 des Olympiades, qui s’est tenue à Shanghai au mois de juillet.
Le modèle « dots-note-3.0 » de Xiaohongshu a participé au test pour la première fois, tandis que le système « Celia », développé par Huawei, a relevé les problèmes proposés, et a démontré sa capacité à fournir des solutions dans plusieurs domaines mathématiques.
Xiaohongshu a souligné qu’obtenir la note maximale lors de ce concours était extrêmement difficile, précisant qu’aucun grand modèle linguistique n’avait jamais atteint ce résultat lors d’une évaluation officielle liée aux Olympiades.
Cette année, 666 participants âgés de moins de 20 ans et provenant de différents pays ont pris part à l’édition ; parmi les participants humains, seuls sept ont réussi à obtenir la note maximale.
Les modèles intelligents ont reçu les questions une fois que les candidats humains avaient terminé l’examen, et devaient élaborer les solutions dans un délai imparti. L’entreprise chinoise a précisé que toute intervention humaine était interdite pendant l’épreuve, avant que les réponses générées par le modèle ne soient transmises aux organisateurs pour évaluation.
Cette prouesse représente un bond en avant par rapport aux résultats des années précédentes. Lors de l’édition 2025, des modèles de « Google » et d’« OpenAI » avaient atteint le niveau de la médaille d’or, mais n’avaient pas obtenu la note maximale enregistrée à l’époque par cinq candidats humains.
Quant aux Olympiades de 2024, un modèle de Google a réussi à décrocher la médaille d’argent, après avoir résolu quatre problèmes sur six, l’élaboration des solutions ayant pris entre deux et trois jours.
Lors d’un test indépendant, l’investisseur américain Dedi Das a soumis les mêmes problèmes des Olympiades à quatre modèles avancés développés par « OpenAI », « Anthropic », « Axiom Math » et « MoonShot AI », et les quatre modèles ont obtenu 42 points sur 42.
Ces résultats indiquent que les tests de mathématiques traditionnels pourraient devenir moins efficaces pour distinguer les modèles les plus performants, alors qu’un nombre croissant de systèmes d’intelligence artificielle se rapprochent du plafond de performance dans les concours et les tests connus.
Toutefois, cette note parfaite ne signifie pas que l’intelligence artificielle soit désormais capable d’accomplir toutes les tâches des mathématiciens, car répondre à des problèmes spécifiques est bien différent de l’élaboration de nouvelles théories ou de la conduite de recherches indépendantes à long terme.
