aiminute. ← Todas las noticias de IA
Industria AI Minute Newsroom 2026-08-16

Los filtros de armas biológicas de Anthropic estuvieron apagados once meses — a lo largo de 133 millones de conversaciones

Los filtros de armas biológicas de Anthropic estuvieron apagados once meses — a lo largo de 133 millones de conversaciones

En su segundo Informe de Riesgo corporativo, publicado el 14 de agosto, Anthropic reveló que los clasificadores de bloqueo destinados a impedir que sus modelos ayuden a fabricar un arma biológica estuvieron inactivos en todo el tráfico de los proveedores de retroalimentación humana entre mayo de 2025 y abril de 2026. Eso abarca unos 133 millones de intercambios con cerca de 50.000 contratistas externos, personas verificadas únicamente por los proveedores que las contrataron. Entre los modelos expuestos en ese periodo estaba Mythos Preview, uno de los más capaces de la empresa, que operó tras ese hueco durante unas dos semanas. La compañía afirma que su investigación interna no halló pruebas de uso indebido real, que ningún cliente se vio afectado y que desde entonces ha endurecido los requisitos para contratistas y cerrado la brecha.

Por qué importaEl argumento público de Anthropic a favor de su propio marco de seguridad se apoya sobre todo en el riesgo de armas biológicas, y la empresa no advirtió que su filtro principal para ese riesgo llevaba casi un año apagado. Las promesas de seguridad descansan sobre una fontanería que puede romperse en silencio sin que nadie dé la alarma. También muestra dónde está realmente el modelo sin filtrar: no con los clientes que pagan, sino con decenas de miles de trabajadores subcontratados a los que examina otro.

✓ Verificado · 3 fuentes

WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

ChatGPT firma sus viñetas falsas con el nombre de dibujantes reales.
2026-10-06
Qualcomm licenciará el método de Huawei para apilar dos obleas.
2026-10-06
Wikimedia sospecha de agentes de OpenAI por la caída de mayo.
2026-10-06
OpenAI despidió a tres empleados de seguridad por filtrar material.
2026-10-05
OpenAI pondrá anuncios junto a las imágenes que pidas a ChatGPT.
2026-10-05