Industrie
AI Minute Newsroom
2026-08-16
Les filtres « armes biologiques » d'Anthropic sont restés désactivés onze mois — sur 133 millions de conversations
Dans son deuxième rapport de risque à l'échelle de l'entreprise, publié le 14 août, Anthropic a révélé que les classifieurs de blocage censés empêcher ses modèles d'aider à fabriquer une arme biologique étaient inactifs sur l'ensemble du trafic des prestataires de retour humain, de mai 2025 à avril 2026. Cela représente environ 133 millions d'échanges avec quelque 50 000 sous-traitants externes, vérifiés uniquement par les prestataires qui les avaient recrutés. Parmi les modèles exposés durant cette période figurait Mythos Preview, l'un des plus performants de la maison, resté environ deux semaines derrière cette faille. L'entreprise indique que son enquête interne n'a trouvé aucune preuve d'usage abusif réel, qu'aucun client n'a été touché, et qu'elle a depuis durci ses exigences envers les sous-traitants et comblé la faille.
Pourquoi c'est importantL'argumentaire public d'Anthropic en faveur de son propre cadre de sécurité repose largement sur le risque d'armes biologiques — et l'entreprise n'a pas remarqué que son filtre principal contre ce risque était coupé pendant près d'un an. Les promesses de sécurité reposent sur une plomberie qui peut se briser en silence, sans que personne ne tire la sonnette d'alarme. Cela montre aussi où se trouve réellement le modèle non filtré : pas chez les clients payants, mais chez des dizaines de milliers de sous-traitants sélectionnés par quelqu'un d'autre.
✓ Vérifié · 3 sources
Lire dans l'app — gratuit, en 9 langues
Actus liées
ChatGPT signe ses faux dessins du nom de vrais dessinateurs.
2026-10-06Qualcomm achète la licence d'un procédé de puces chinois.
2026-10-06Wikimédia soupçonne des agents d'OpenAI pour la panne de mai.
2026-10-06OpenAI a licencié trois employés de sécurité pour une fuite externe.
2026-10-05OpenAI placera des publicités à côté des images que ChatGPT dessine.
2026-10-05