Recherche
2026-08-03
Meta donne aux agents IA un coach dont l'unique tâche est de leur rappeler ce qu'ils savent déjà
Des chercheurs de Meta AI nomment un mode de défaillance : la « dégradation de l'état comportemental ». Dans une tâche longue, l'exigence ou la commande ratée se trouvent toujours dans la fenêtre de contexte de l'agent, mais au moment d'agir, cette information ne pèse plus sur la décision. Leur correctif ne touche pas à l'agent qui travaille : il fait tourner à côté un second agent « mémoire », plus petit, qui tient un registre structuré d'états, de faits et de procédures et choisit à chaque étape entre glisser un bref rappel ou se taire. Sur Terminal-Bench 2.0, Claude Sonnet 4.5 passe de 37,6 % à 45,9 % en pass@1 — 8,3 points — et sur τ²-Bench de 55,0 % à 61,8 %. Le code est public.
Pourquoi c'est importantPresque toutes les autres tentatives pour réparer la mémoire des agents ajoutent de la recherche documentaire : verser plus de texte dans la fenêtre et espérer que le modèle le lise. Cet article soutient l'inverse — les agents se noient dans leurs propres transcriptions et ce qu'il leur faut, c'est un éditeur, pas une archive. Si un petit modèle superviseur peut acheter huit points sur un banc d'essai difficile sans toucher au modèle principal, c'est une amélioration exceptionnellement bon marché pour tout agent de code ou de support fonctionnant longtemps.
✓ Vérifié · 3 sources
▶ Vidéo associée: Remember When It Matters: Proactive Memory Agent for Long-Horizon Agents (Jul 2026)
Lire dans l'app — gratuit, en 9 langues
Actus liées
L'apprentissage automatique a lu la forme de cellules cérébrales malades et retenu neuf médicaments déjà autorisés qui les ont apaisées
2026-08-21Rumeur : le modèle anonyme qui vient de dominer un test de programmation, gratuitement, serait le fleuron non publié de Zhipu
2026-08-21Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21Nvidia paie 6 milliards de dollars pour la machine qui fabrique les modèles d'un rival — et embauche 109 de ceux qui la faisaient tourner
2026-08-21Quatre heures et un GPU pour améliorer la façon dont on entraîne l'IA : le meilleur agent obtient 0,25 sur 1 — et la plupart n'ont même pas essayé
2026-08-21