Sur les problèmes inédits de la 67ᵉ Olympiade internationale de mathématiques (IMO), organisée à
Shanghai en juillet 2026, Claude Fable 5 (Anthropic), GPT-5.6 Sol (OpenAI) et Kimi K3 (Moonshot AI)
obtiennent chacun un score parfait de 42/42. Mais aucun des trois laboratoires n'a publié de
communiqué à ce sujet : la page de lancement officielle de Claude Fable 5 sur anthropic.com ne
mentionne ni l'IMO ni un score mathématique, et il n'existe pas davantage d'annonce dédiée côté
OpenAI ou Moonshot AI.
Ces 42/42 proviennent d'un test mené indépendamment par Deedy Das, partner chez Menlo
Ventures, qui a fait passer plusieurs modèles sur les six problèmes de l'IMO 2026 via une boucle
agentique minimale — trois outils (bash, écriture et lecture de fichiers), sans accès internet,
identique pour tous les modèles — et publié les preuves et la notation sur son propre dépôt
GitHub (deedy/imo-2026). Das qualifie lui-même ses résultats de « non officiels », et précise
que la correction a été assurée par des agents fondés sur Claude, pas par des correcteurs humains
ni par l'IMO.
Le seul circuit véritablement officiel de l'IMO 2026 — problèmes communiqués après la fin de
l'épreuve humaine, fenêtre de soumission fixe, aucune intervention humaine, correction assurée par
les organisateurs eux-mêmes — n'a concerné que deux systèmes, tous deux chinois : Huawei
Celia et dots.note 3.0 de Xiaohongshu, chacun crédité de 42/42 par l'IMO. Claude, GPT et
Kimi n'en faisaient pas partie.
D'après le dépôt de Das, Claude Fable 5 est le seul des trois à avoir obtenu son 42/42 en une
seule passe, sans retour du correcteur : 2 h 30 de résolution pour environ 51,05 dollars de
calcul — un peu au-dessus de la fourchette de 10 à 50 dollars généralement citée. GPT-5.6 Sol
atteint le même score en 3 h 48 pour environ 20,54 dollars, mais après des tours de correction
consécutifs à un retour de relecture. Kimi K3 y arrive également, moyennant 17 h 24 de calcul
pour environ 31,40 dollars et les mêmes corrections a posteriori. À titre de comparaison, les
candidats humains disposent de 9 heures au total (deux séances de 4 h 30) pour les six
problèmes — ce qui rend la performance de Claude Fable 5, seul à boucler l'épreuve sans repêchage,
nettement plus rapide.
La start-up Axiom Math, fondée par Carina Hong, aurait poussé la démonstration plus loin en
vérifiant formellement en Lean 4 chacune des six preuves — environ 8 000 lignes de code et 25
heures de travail, selon des comptes rendus tiers reprenant le test de Das. Ce résultat n'apparaît
toutefois pas sur le site officiel d'Axiom Math, qui ne documente pour l'instant qu'une autre
annonce, distincte, sur les écarts entre nombres premiers (théorème BGP246, publiée en août 2026).
Le repère cité pour l'année précédente — 35/42 pour les meilleurs modèles — est fondé : à l'IMO
2025, Gemini (Google DeepMind) et un modèle d'OpenAI avaient chacun atteint 35/42, franchissant le
seuil de médaille d'or sans être classés, l'IMO ayant explicitement exclu ces résultats de son
tableau officiel.
- GitHub — deedy/imo-2026 — dépôt du test indépendant, scores, temps et coûts détaillés par modèle
- Anthropic — Claude Fable 5 and Claude Mythos 5 — annonce officielle du modèle, sans mention de l'IMO 2026
- Axiom Math — site officiel — aucune mention de l'IMO 2026 à la date de vérification ; seule annonce documentée : théorème BGP246 (août 2026)
- France 24 — AI catches up with humans to score 100% at top maths contest — 23 juillet 2026, distinction entre systèmes gradés par l'IMO (Huawei, Xiaohongshu) et tests indépendants
- Digital Applied — Four AIs Scored a Perfect 42/42 on IMO 2026. So What? — synthèse des chiffres du test Das et du contexte Axiom Math
- Math-Soc — 2025 International Mathematical Olympiad results are in — confirmation des scores 35/42 (Gemini, OpenAI) à l'IMO 2025, hors classement officiel
- IMO officiel — 2026 officially opens in Shanghai — photo de la cérémonie d'ouverture, IMO 2026