Investigación
2026-08-03
Meta le pone a los agentes de IA un entrenador cuya única tarea es recordarles lo que ya saben
Investigadores de Meta AI ponen nombre a un fallo: 'decaimiento del estado conductual'. En una tarea larga, el requisito o el comando que falló siguen dentro de la ventana de contexto del agente, pero cuando llega el momento de actuar esa información ya no moldea la decisión. Su solución no toca al agente que trabaja: ejecuta a su lado un segundo agente 'de memoria', más pequeño, que mantiene un registro estructurado de estado, hechos y procedimientos y decide en cada paso si inyecta un recordatorio breve o se calla. En Terminal-Bench 2.0, Claude Sonnet 4.5 pasó del 37,6% al 45,9% en pass@1 — 8,3 puntos — y en τ²-Bench del 55,0% al 61,8%. El código es público.
Por qué importaCasi todos los demás intentos de arreglar la memoria de los agentes añaden más recuperación: meter más texto en la ventana y confiar en que el modelo lo lea. Este trabajo sostiene lo contrario: los agentes se ahogan en sus propias transcripciones y lo que necesitan es un editor, no un archivo. Si un modelo supervisor pequeño puede comprar ocho puntos en un banco de pruebas difícil sin tocar el principal, es una mejora insólitamente barata para cualquier agente de programación o soporte de larga duración.
✓ Verificado · 3 fuentes
▶ Vídeo relacionado: Remember When It Matters: Proactive Memory Agent for Long-Horizon Agents (Jul 2026)
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
El aprendizaje automático leyó la forma de células cerebrales enfermas y eligió nueve fármacos ya aprobados que las calmaron
2026-08-21Rumor: el modelo anónimo que acaba de encabezar un test de programación, gratis, sería el buque insignia sin publicar de Zhipu
2026-08-21El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21Nvidia paga 6.000 millones de dólares por la máquina que fabrica los modelos de un rival — y contrata a 109 de quienes la manejaban
2026-08-21Con cuatro horas y una GPU para mejorar la forma en que se entrena la IA, el mejor agente sacó 0,25 sobre 1 — y la mayoría ni lo intentó
2026-08-21