Anthropic lance Claude Opus 4.6, avec une fenêtre de contexte de 1 million de tokens

Anthropic annonce le 5 février 2026 Claude Opus 4.6, son nouveau modèle phare pour le raisonnement et les tâches agentiques, avec une fenêtre de contexte d'un million de tokens en bêta et les meilleurs scores du secteur sur Terminal-Bench 2.0 et Humanity's Last Exam.

3 min5 février 2026

Ce qu'Anthropic annonce

Le 5 février 2026, Anthropic publie « Introducing Claude Opus 4.6 », présentant son nouveau modèle phare pour le raisonnement et les tâches agentiques — du codage à l'analyse financière, en passant par la cybersécurité, le raisonnement juridique et la gestion autonome de tâches longues. Le modèle est disponible dès le lancement sur claude.ai, l'API Anthropic et les principales plateformes cloud partenaires.

Anthropic met en avant des usages concrets : conduire des analyses financières, mener des recherches, ou encore créer et manipuler documents, tableurs et présentations de façon autonome.

Les chiffres

  • Terminal-Bench 2.0 (évaluation du codage agentique) : Anthropic revendique le meilleur score du secteur, sans publier de pourcentage exact sur la page d'annonce.
  • Humanity's Last Exam (test de raisonnement pluridisciplinaire) : Opus 4.6 devance tous les autres modèles de pointe, avec un score de 53,0 % avec outils (chiffre corrigé par Anthropic depuis une valeur initiale de 53,1 %).
  • GDPval-AA : le modèle devance GPT-5.2 d'environ 144 points Elo, et son prédécesseur Claude Opus 4.5 d'environ 190 points Elo.
  • BrowseComp (recherche d'informations difficiles à trouver en ligne) : Anthropic revendique là aussi la meilleure performance du secteur.
  • MRCR v2, variante à huit aiguilles sur fenêtre de 1 million de tokens : Opus 4.6 obtient 76 %, contre 18,5 % pour Claude Sonnet 4.5 — l'écart mis en avant par Anthropic pour illustrer le gain sur la restitution d'information en contexte long.

Contexte étendu et tarification

Claude Opus 4.6 est le premier modèle de la famille Opus à proposer une fenêtre de contexte d'un million de tokens, disponible en bêta et réservée à la Claude Developer Platform. Le modèle supporte par ailleurs jusqu'à 128 000 tokens de sortie.

Côté tarification, les prix standards restent inchangés : 5 $ par million de tokens en entrée et 25 $ par million de tokens en sortie. Au-delà de 200 000 tokens de contexte, une tarification premium s'applique sur la Claude Developer Platform : 10 $ par million de tokens en entrée et 37,50 $ par million de tokens en sortie. Anthropic mentionne par ailleurs des réductions possibles allant jusqu'à 90 % via la mise en cache des prompts et 50 % via le traitement en batch.

La sécurité

Anthropic indique que, sur son audit comportemental automatisé, Opus 4.6 affiche un taux faible de comportements mésalignés — tromperie, flatterie excessive, encouragement des délires de l'utilisateur, coopération avec un usage malveillant — et se positionne comme au moins aussi bien aligné que son prédécesseur Claude Opus 4.5, jusqu'ici le modèle le plus aligné produit par l'entreprise. Anthropic revendique également le taux de refus excessifs le plus bas parmi les modèles Claude récents, sans publier de chiffre précis sur ce point.

Sources

  • Anthropic — Introducing Claude Opus 4.6 — 5 février 2026, annonce officielle

Partager cet article

À lire aussi

Avant de partir

Faut-il basculer vers Claude Opus 4.6 et son million de tokens ?

Passé 200 000 tokens de contexte, la tarification change : le bon choix dépend de vos usages réels.