Anthropic dévoile « Dreaming », un mécanisme d'auto-amélioration pour les agents Claude

Anthropic présente Dreaming, un processus de fond qui relit les sessions passées d'un agent Claude, en extrait les erreurs récurrentes et consolide des notes dans sa mémoire longue durée — sans ré-entraîner le modèle. Harvey rapporte un gain de productivité x6 sur ses tâches juridiques.

3 min6 mai 2026

Le principe

Le 6 mai 2026, dans le cadre de « Code with Claude 2026 », Anthropic présente Dreaming, une fonctionnalité en aperçu de recherche (research preview) conçue pour que les agents Claude s'améliorent d'une session à l'autre sans ré-entraînement du modèle. Le mécanisme fonctionne en tâche de fond, sur un rythme programmé : il relit les sessions passées d'un agent, identifie les erreurs récurrentes et les schémas qui se répètent, puis consolide le résultat sous forme de notes écrites dans la mémoire longue durée de l'agent.

Le choix de conception mis en avant est la séparation entre la couche d'amélioration et la couche modèle : Dreaming ne modifie pas les poids du modèle, il alimente une mémoire externe que l'agent consulte ensuite. Anthropic précise également que ces notes restent du texte lisible par des humains — un choix explicitement motivé par la transparence, pour que les équipes puissent auditer ce que l'agent a « appris » plutôt que de dépendre d'une boîte noire.

Le contexte de l'annonce

Dreaming est annoncé le même jour que l'accord de calcul avec SpaceX (accès à la capacité du data center Colossus 1) et aux côtés d'autres fonctionnalités orientées agents : « outcomes », l'orchestration multi-agents et les webhooks — un ensemble d'annonces centré sur la fiabilité et l'autonomie des agents Claude en production plutôt que sur les capacités brutes du modèle.

Le chiffre cité : Harvey, x6

Parmi les premiers utilisateurs cités, Harvey, une entreprise spécialisée en IA juridique, rapporte une hausse d'environ six fois son taux d'achèvement de tâches après l'activation de Dreaming sur ses agents. Ce chiffre provient de la couverture presse de l'annonce, pas d'un communiqué chiffré publié par Anthropic elle-même sur sa propre page — il est donc à traiter comme un retour d'usage rapporté, pas comme une mesure benchmark standardisée.

Point de rigueur : aucune page officielle anthropic.com dédiée à Dreaming n'a pu être retrouvée et vérifiée en direct au moment de la rédaction — l'annonce est documentée ici via plusieurs recoupements presse indépendants (VentureBeat, YourStory) qui convergent sur les mêmes détails techniques et le même chiffre Harvey, ce qui donne une confiance raisonnable sans équivaloir à une source primaire directement consultée.

Sources

  • VentureBeat — Anthropic introduces 'Dreaming,' a system that lets AI agents learn from their own mistakes — 6 mai 2026
  • YourStory — couverture de l'annonce Dreaming — 6 mai 2026, corrobore les mêmes détails (mémoire longue durée, notes lisibles, chiffre Harvey)

Partager cet article

À lire aussi

Avant de partir

Harvey rapporte un gain de productivité x6 grâce à Dreaming ?

Cette mémoire longue durée, lisible par des humains, ouvre la voie à un vrai audit de vos agents IA.