Claude, GPT et Kimi décrochent un score parfait à l'IMO 2026, hors notation officielle

Un test indépendant mené par un investisseur de Menlo Ventures crédite Claude Fable 5, GPT-5.6 Sol et Kimi K3 de 42/42 aux problèmes de l'Olympiade internationale de mathématiques 2026. Aucun des trois laboratoires n'a communiqué officiellement sur ce résultat, et seuls deux systèmes chinois ont été réellement soumis à la notation de l'IMO.

4 min22 juillet 2026

Un test indépendant, pas une annonce de laboratoire

Sur les problèmes inédits de la 67ᵉ Olympiade internationale de mathématiques (IMO), organisée à Shanghai en juillet 2026, Claude Fable 5 (Anthropic), GPT-5.6 Sol (OpenAI) et Kimi K3 (Moonshot AI) obtiennent chacun un score parfait de 42/42. Mais aucun des trois laboratoires n'a publié de communiqué à ce sujet : la page de lancement officielle de Claude Fable 5 sur anthropic.com ne mentionne ni l'IMO ni un score mathématique, et il n'existe pas davantage d'annonce dédiée côté OpenAI ou Moonshot AI.

Ces 42/42 proviennent d'un test mené indépendamment par Deedy Das, partner chez Menlo Ventures, qui a fait passer plusieurs modèles sur les six problèmes de l'IMO 2026 via une boucle agentique minimale — trois outils (bash, écriture et lecture de fichiers), sans accès internet, identique pour tous les modèles — et publié les preuves et la notation sur son propre dépôt GitHub (deedy/imo-2026). Das qualifie lui-même ses résultats de « non officiels », et précise que la correction a été assurée par des agents fondés sur Claude, pas par des correcteurs humains ni par l'IMO.

Ce que l'IMO a réellement noté

Le seul circuit véritablement officiel de l'IMO 2026 — problèmes communiqués après la fin de l'épreuve humaine, fenêtre de soumission fixe, aucune intervention humaine, correction assurée par les organisateurs eux-mêmes — n'a concerné que deux systèmes, tous deux chinois : Huawei Celia et dots.note 3.0 de Xiaohongshu, chacun crédité de 42/42 par l'IMO. Claude, GPT et Kimi n'en faisaient pas partie.

Les chiffres, modèle par modèle

D'après le dépôt de Das, Claude Fable 5 est le seul des trois à avoir obtenu son 42/42 en une seule passe, sans retour du correcteur : 2 h 30 de résolution pour environ 51,05 dollars de calcul — un peu au-dessus de la fourchette de 10 à 50 dollars généralement citée. GPT-5.6 Sol atteint le même score en 3 h 48 pour environ 20,54 dollars, mais après des tours de correction consécutifs à un retour de relecture. Kimi K3 y arrive également, moyennant 17 h 24 de calcul pour environ 31,40 dollars et les mêmes corrections a posteriori. À titre de comparaison, les candidats humains disposent de 9 heures au total (deux séances de 4 h 30) pour les six problèmes — ce qui rend la performance de Claude Fable 5, seul à boucler l'épreuve sans repêchage, nettement plus rapide.

Une preuve formelle en plus, non confirmée par le principal intéressé

La start-up Axiom Math, fondée par Carina Hong, aurait poussé la démonstration plus loin en vérifiant formellement en Lean 4 chacune des six preuves — environ 8 000 lignes de code et 25 heures de travail, selon des comptes rendus tiers reprenant le test de Das. Ce résultat n'apparaît toutefois pas sur le site officiel d'Axiom Math, qui ne documente pour l'instant qu'une autre annonce, distincte, sur les écarts entre nombres premiers (théorème BGP246, publiée en août 2026).

Le point de comparaison avec 2025 se confirme

Le repère cité pour l'année précédente — 35/42 pour les meilleurs modèles — est fondé : à l'IMO 2025, Gemini (Google DeepMind) et un modèle d'OpenAI avaient chacun atteint 35/42, franchissant le seuil de médaille d'or sans être classés, l'IMO ayant explicitement exclu ces résultats de son tableau officiel.

Sources

  • GitHub — deedy/imo-2026 — dépôt du test indépendant, scores, temps et coûts détaillés par modèle
  • Anthropic — Claude Fable 5 and Claude Mythos 5 — annonce officielle du modèle, sans mention de l'IMO 2026
  • Axiom Math — site officiel — aucune mention de l'IMO 2026 à la date de vérification ; seule annonce documentée : théorème BGP246 (août 2026)
  • France 24 — AI catches up with humans to score 100% at top maths contest — 23 juillet 2026, distinction entre systèmes gradés par l'IMO (Huawei, Xiaohongshu) et tests indépendants
  • Digital Applied — Four AIs Scored a Perfect 42/42 on IMO 2026. So What? — synthèse des chiffres du test Das et du contexte Axiom Math
  • Math-Soc — 2025 International Mathematical Olympiad results are in — confirmation des scores 35/42 (Gemini, OpenAI) à l'IMO 2025, hors classement officiel
  • IMO officiel — 2026 officially opens in Shanghai — photo de la cérémonie d'ouverture, IMO 2026

Partager cet article

À lire aussi

Avant de partir

Claude Fable 5 réussit l'IMO 2026 sans un seul repêchage