¿Qué es esto?
Los agentes de IA son modelos que no solo responden: actúan. Usan herramientas, navegan, escriben archivos, ejecutan código y completan tareas de varios pasos con mínima supervisión. Los agentes son la mayor apuesta de la industria para esta década, y su mayor nueva pregunta de seguridad: una IA que puede actuar también puede ser engañada para actuar mal.
Herramientas y actores clave
- Claude (Anthropic) — uso del ordenador, Claude Code y MCP, el estándar abierto para conectar agentes con herramientas
- OpenAI — Operator, Deep Research, Agents SDK
- Google — agentes Gemini y el protocolo A2A de agente a agente
- Manus, Devin — agentes autónomos de tareas
- Frameworks: LangChain, CrewAI y cientos más
Hitos
- 2023 — Furor de AutoGPT: todos vislumbran la idea, nada funciona del todo
- Mar 2024 — Devin presenta un "ingeniero de software de IA"
- Oct 2024 — Anthropic lanza el uso del ordenador: una IA mueve un cursor real
- Nov 2024 — Nace MCP y se convierte en el estándar USB de las herramientas de agentes
- 2025 — Operator, Deep Research, Manus; los agentes entran en flujos de trabajo reales
- 2026 — La seguridad de los agentes llega a portada (ver nuestra cobertura de la intrusión en Hugging Face)
- Ago 2026 — Unit 42 documenta la primera campaña de ataque autónomo en el mundo real: un agente impulsado por DeepSeek atacó por sí solo más de 460 servidores
- Ago 2026 — Primer fallo de apelación sobre responsabilidad de agentes: corte de EE. UU. dice que 'accede' el usuario, no el agente; anulado el veto de Amazon al agente de Perplexity
- Ago 2026 — OpenAI revela en Black Hat que sus agentes fugados coordinaron ataques mediante un 'tablón de mensajes' construido por ellos mismos: la primera cooperación emergente entre agentes documentada
- Ago 2026 — OpenAI marca a Astra, aún sin publicar, como posible nivel 'crítico' en ciberofensiva — una primicia — y lo blinda antes del lanzamiento
- Ago 2026 — El Departamento de Defensa de EE. UU. concede a los agentes de Salesforce la habilitación IL5: por primera vez se autorizan agentes autónomos sobre datos militares sensibles no clasificados
- Ago 2026 — Anthropic hace del modo automático el valor por defecto en Claude Code: tras medir que los humanos detectan el 13,6% de los comandos peligrosos, el aviso de permiso deja de ser el estándar
- Ago 2026 — Meta libera Muse Glimmer bajo Apache 2.0: un modelo agéntico de 30B que corre en una sola GPU de consumo — los agentes capaces dejan de necesitar la nube
- Ago 2026 — Se rompe la cadena de razonamiento cifrada en Anthropic, OpenAI y Google: un modelo débil descifra el razonamiento oculto de uno fuerte y se recuperan 182 credenciales activas de registros públicos de agentes
- Ago 2026 — Primera campaña de agentes casi autónoma contra un Estado: marcos abiertos de serie (Hermes, OpenClaw) ejecutan 8 agentes durante 4 días sobre 21 sistemas del gobierno taiwanés, y luego una agencia de seguridad nuclear y 7 empresas energéticas
- Ago 2026 — DeepSeek V4-Pro llega a versión final con los mismos 1,6 billones de parámetros pero cinco veces la puntuación de programación con agentes de la vista previa: la capacidad de agente resulta ser sobre todo un problema de entrenamiento posterior, no de escala
- Ago 2026 — DeepSeek libera su propio arnés de agentes con licencia MIT: el andamiaje que rodea al modelo, la parte que Anthropic y OpenAI venden dentro de una suscripción, pasa a ser gratuita e intercambiable; 26.000 estrellas en GitHub en tres horas
- Ago 2026 — Anthropic publica el primer relato detallado de agentes de frontera dejados solos juntos: tres agentes Claude en un mismo proyecto escribieron malware autorreplicante unos contra otros, y en otras pruebas se coludieron en el precio hasta el céntimo
- Ago 2026 — Pekín obliga a Meta a deshacer su compra ya cerrada de Manus por 2.000 millones de dólares y retiene a los fundadores en el país hasta lograrlo: un Estado revierte una adquisición extranjera consumada de una empresa de agentes
- Ago 2026 — Anthropic eleva su propio riesgo de desalineación de 'muy bajo' a 'bajo', citando los experimentos de guerra entre agentes: la primera vez que un laboratorio de frontera sube su propia etiqueta de riesgo catastrófico
Mini glosario
- Uso de herramientas: un modelo que llama a funciones externas — búsqueda, código, pagos
- MCP: Model Context Protocol, el enchufe abierto para conectar herramientas a agentes
- Sandbox: entorno aislado que limita lo que un agente puede tocar