Le 5 mars 2026, OpenAI publie « Introducing GPT-5.4 » et présente le modèle comme le premier
modèle de raisonnement grand public à intégrer les capacités de code de pointe de
GPT-5.3-Codex au sein d'un modèle frontière unique, réunissant ses avancées récentes en
raisonnement, en code et en flux agentiques. Le déploiement démarre le jour même,
progressivement, sur trois canaux : ChatGPT (sous le nom GPT-5.4 Thinking), l'API
(identifiant gpt-5.4, snapshot par défaut gpt-5.4-2026-03-05) et Codex. OpenAI publie en
parallèle une variante plus poussée, GPT-5.4 Pro (identifiant API gpt-5.4-pro), disponible
elle aussi dans ChatGPT et l'API.
GPT-5.4 introduit cinq niveaux d'effort de raisonnement configurables via le paramètre
reasoning.effort de l'API : none (par défaut), low, medium, high et xhigh — ce
dernier niveau étant celui utilisé pour les meilleurs scores de benchmark du modèle.
Le modèle embarque un outil « computer use » natif (computer_use dans la Responses API) :
il perçoit un écran, clique, saisit du texte et navigue dans des applications de bureau ou du
navigateur, avec un support pour l'exécution de code via des bibliothèques comme Playwright.
Sa fenêtre de contexte peut atteindre environ 1,05 million de tokens dans Codex et l'API
(pour une sortie maximale de 128 000 tokens), la pleine fenêtre étendue restant une
configuration explicite, présentée comme expérimentale.
- GDPval (travaux professionnels réels sur 44 métiers issus des neuf secteurs qui pèsent le
plus dans le PIB américain) : GPT-5.4, en effort de raisonnement
xhigh, égale ou dépasse les
professionnels du secteur dans 83,0 % des comparaisons, contre 70,9 % pour GPT-5.2.
- OSWorld-Verified (tâches d'usage d'ordinateur) : 75,0 %, contre 47,3 % pour
GPT-5.2.
- SWE-Bench Pro (code) : 57,7 %.
- Toolathlon (usage d'outils) : 54,6 %.
- La fonction de recherche d'outils (« tool search ») réduirait de 47 % la consommation de
tokens sur les tâches testées, à précision égale.
Ces chiffres sont ceux mis en avant par OpenAI dans son propre communiqué ; aucun tiers
indépendant ne les a encore recoupés au moment de la publication.
Dans ChatGPT, GPT-5.4 Thinking est accessible aux offres Plus, Team et Pro. GPT-5.4
Pro est réservé aux offres Pro et Enterprise ; les organisations Enterprise et Edu peuvent
toutefois activer un accès anticipé via les réglages d'administration.
Côté API, OpenAI affiche pour gpt-5.4 un tarif de 2,50 $ par million de tokens en entrée
(0,25 $ en entrée mise en cache) et 15,00 $ par million de tokens en sortie, pour un contexte
standard jusqu'à 272 000 tokens — un contexte étendu au-delà déclenche une tarification
supérieure. OpenAI ne communique pas de tarif unique et stable pour GPT-5.4 Pro : les chiffres
qui circulent ($15/$90 puis $30/$180 par million de tokens selon les relevés) varient dans le
temps et ne sont pas recoupables de façon fiable ; ils sont donc omis ici.
Le 17 mars 2026, OpenAI complète la famille avec GPT-5.4 mini (accessible aux comptes
gratuits de ChatGPT) et GPT-5.4 nano (disponible uniquement via l'API).
- OpenAI — Introducing GPT-5.4 — 5 mars 2026, annonce officielle
- OpenAI Developers — GPT-5.4 (documentation du modèle) — identifiants d'API, niveaux d'effort de raisonnement, fenêtre de contexte et tarifs
- OpenAI Developer Community — GPT-5.4 Pro and Thinking are here — reprise officielle des détails de déploiement et des benchmarks
- OpenAI — Introducing GPT-5.4 mini and nano — 17 mars 2026, extension de la famille