Le 5 février 2026, Anthropic publie « Introducing Claude Opus 4.6 », présentant son nouveau
modèle phare pour le raisonnement et les tâches agentiques — du codage à l'analyse
financière, en passant par la cybersécurité, le raisonnement juridique et la gestion autonome
de tâches longues. Le modèle est disponible dès le lancement sur claude.ai, l'API Anthropic et
les principales plateformes cloud partenaires.
Anthropic met en avant des usages concrets : conduire des analyses financières, mener des
recherches, ou encore créer et manipuler documents, tableurs et présentations de façon
autonome.
- Terminal-Bench 2.0 (évaluation du codage agentique) : Anthropic revendique le meilleur
score du secteur, sans publier de pourcentage exact sur la page d'annonce.
- Humanity's Last Exam (test de raisonnement pluridisciplinaire) : Opus 4.6 devance tous
les autres modèles de pointe, avec un score de 53,0 % avec outils (chiffre corrigé par
Anthropic depuis une valeur initiale de 53,1 %).
- GDPval-AA : le modèle devance GPT-5.2 d'environ 144 points Elo, et son prédécesseur
Claude Opus 4.5 d'environ 190 points Elo.
- BrowseComp (recherche d'informations difficiles à trouver en ligne) : Anthropic revendique
là aussi la meilleure performance du secteur.
- MRCR v2, variante à huit aiguilles sur fenêtre de 1 million de tokens : Opus 4.6 obtient
76 %, contre 18,5 % pour Claude Sonnet 4.5 — l'écart mis en avant par Anthropic pour
illustrer le gain sur la restitution d'information en contexte long.
Claude Opus 4.6 est le premier modèle de la famille Opus à proposer une fenêtre de contexte
d'un million de tokens, disponible en bêta et réservée à la Claude Developer
Platform. Le modèle supporte par ailleurs jusqu'à 128 000 tokens de sortie.
Côté tarification, les prix standards restent inchangés : 5 $ par million de tokens en
entrée et 25 $ par million de tokens en sortie. Au-delà de 200 000 tokens de contexte, une
tarification premium s'applique sur la Claude Developer Platform : 10 $ par million de tokens
en entrée et 37,50 $ par million de tokens en sortie. Anthropic mentionne par ailleurs des
réductions possibles allant jusqu'à 90 % via la mise en cache des prompts et 50 % via le
traitement en batch.
Anthropic indique que, sur son audit comportemental automatisé, Opus 4.6 affiche un taux
faible de comportements mésalignés — tromperie, flatterie excessive, encouragement des
délires de l'utilisateur, coopération avec un usage malveillant — et se positionne comme
au moins aussi bien aligné que son prédécesseur Claude Opus 4.5, jusqu'ici le modèle le
plus aligné produit par l'entreprise. Anthropic revendique également le taux de refus
excessifs le plus bas parmi les modèles Claude récents, sans publier de chiffre précis sur
ce point.
- Anthropic — Introducing Claude Opus 4.6 — 5 février 2026, annonce officielle