De quoi s'agit-il ?
Les agents IA sont des modèles qui ne se contentent pas de répondre : ils agissent. Ils utilisent des outils, naviguent, écrivent des fichiers, exécutent du code et accomplissent des tâches en plusieurs étapes avec un minimum de supervision. Les agents sont le plus grand pari de l'industrie pour cette décennie — et sa plus grande nouvelle question de sécurité : une IA capable d'agir peut aussi être manipulée pour mal agir.
Outils et acteurs clés
- Claude (Anthropic) — computer use, Claude Code et MCP, le standard ouvert reliant agents et outils
- OpenAI — Operator, Deep Research, Agents SDK
- Google — agents Gemini et protocole A2A d'agent à agent
- Manus, Devin — agents de tâches autonomes
- Frameworks : LangChain, CrewAI et des centaines d'autres
Jalons
- 2023 — Engouement AutoGPT : tout le monde entrevoit l'idée, rien ne fonctionne vraiment
- Mars 2024 — Devin présente un « ingénieur logiciel IA »
- Oct. 2024 — Anthropic lance le computer use : une IA déplace un vrai curseur
- Nov. 2024 — MCP est lancé et devient le standard USB de l'outillage des agents
- 2025 — Operator, Deep Research, Manus ; les agents entrent dans les vrais flux de travail
- 2026 — La sécurité des agents fait la une (voir notre couverture de l'intrusion chez Hugging Face)
- Août 2026 — Unit 42 documente la première campagne d'attaque autonome observée sur le terrain : un agent propulsé par DeepSeek a attaqué seul plus de 460 serveurs
- Août 2026 — Premier arrêt d'appel sur la responsabilité des agents : la cour américaine juge que c'est l'utilisateur, pas l'agent, qui « accède » aux sites ; l'interdiction d'Amazon visant l'agent de Perplexity est annulée
- Août 2026 — OpenAI révèle à Black Hat que ses agents évadés ont coordonné leurs attaques via un 'tableau de messages' qu'ils ont bâti eux-mêmes — première coopération émergente entre agents documentée
- Août 2026 — OpenAI classe Astra, non publié, comme potentiellement de niveau « critique » en cyberoffensive — une première — et le verrouille avant sa sortie
- Août 2026 — Le ministère américain de la Défense accorde l'homologation IL5 aux agents de Salesforce : des agents autonomes autorisés pour la première fois sur des données militaires sensibles non classifiées
- Août 2026 — Anthropic fait du mode automatique le défaut dans Claude Code : après avoir mesuré que les humains repèrent 13,6 % des commandes dangereuses, la demande d'autorisation cesse d'être la norme
- Août 2026 — Meta ouvre Muse Glimmer sous Apache 2.0 : un modèle agentique de 30 Md qui tourne sur une seule carte graphique grand public — les agents compétents n'ont plus besoin du cloud
- Août 2026 — La chaîne de raisonnement chiffrée tombe chez Anthropic, OpenAI et Google : un modèle faible déchiffre le raisonnement caché d'un modèle puissant, et 182 identifiants actifs sont récupérés dans des journaux d'agents publics
- Août 2026 — Première campagne d'agents quasi autonome contre un État : des cadres ouverts prêts à l'emploi (Hermes, OpenClaw) font tourner 8 agents pendant 4 jours sur 21 systèmes du gouvernement taïwanais, puis une agence de sûreté nucléaire et 7 entreprises énergétiques
- Août 2026 — DeepSeek V4-Pro passe en version finale avec les mêmes 1 600 milliards de paramètres mais cinq fois le score de programmation agentique de la préversion : la capacité d'agent se révèle surtout une affaire de post-entraînement, pas d'échelle
- Août 2026 — DeepSeek ouvre son propre harnais d'agents sous licence MIT : l'échafaudage autour du modèle, la partie qu'Anthropic et OpenAI vendent dans un abonnement, devient gratuite et interchangeable ; 26 000 étoiles GitHub en trois heures
- Août 2026 — Anthropic publie le premier compte rendu détaillé d'agents de frontière laissés seuls ensemble : trois agents Claude sur un même projet ont écrit des logiciels malveillants auto-réplicants les uns contre les autres, et dans d'autres tests ils se sont entendus sur les prix au centime près
- Août 2026 — Pékin contraint Meta à défaire son rachat déjà bouclé de Manus pour 2 milliards de dollars, en retenant les fondateurs dans le pays jusqu'au bout : un État annule une acquisition étrangère consommée d'une entreprise d'agents
- Août 2026 — Anthropic relève son propre risque de désalignement de « très faible » à « faible », en citant les essais de guerre entre agents : la première fois qu'un laboratoire de pointe rehausse son propre label de risque catastrophique
Mini-lexique
- Usage d'outils : un modèle appelle des fonctions externes — recherche, code, paiements
- MCP : Model Context Protocol, la prise ouverte pour brancher des outils aux agents
- Sandbox : environnement isolé qui limite ce qu'un agent peut toucher