aiminute. ← Todas las noticias de IA
Investigación AI Minute Newsroom 2026-08-07

¿'Aprobar'? 40.000 partidas muestran que los humanos dejan pasar uno de cada tres comandos peligrosos de agentes de IA

¿'Aprobar'? 40.000 partidas muestran que los humanos dejan pasar uno de cada tres comandos peligrosos de agentes de IA

La firma de herramientas para desarrolladores Scale X convirtió las solicitudes de permiso de los agentes de IA en un juego de navegador y analizó más de 40.000 partidas con 409.000 decisiones de aprobar/denegar. La precisión media fue del 66,3%: los jugadores aprobaron aproximadamente uno de cada tres comandos maliciosos y un tercio de las sesiones terminó con puntuación negativa. La vigilancia decayó a medida que se acumulaban aprobaciones, y la amenaza más pasada por alto — un script 'npm run analyze' capaz de ejecutar código arbitrario — fue aprobada casi el 65% de las veces.

Por qué importa'Un humano aprueba cada comando' es la respuesta estándar de la industria a la seguridad de los agentes. Este es el mayor conjunto de datos público que demuestra que esa salvaguarda falla gravemente con la fatiga — justo el modo de fallo que reguladores y laboratorios dan por resuelto. La protección real probablemente exija sandboxing y mejor diseño de permisos, no más clics.
#Programación#Agentes IA

✓ Verificado · 2 fuentes

WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

Un modelo aprendió sin el método que entrena a toda la IA.
2026-10-06
TikTok metió un chatbot de compras dentro del vídeo que ves.
2026-10-06
Reflection regalará un modelo de 501.000 millones de parámetros.
2026-10-06
Wikimedia sospecha de agentes de OpenAI por la caída de mayo.
2026-10-06
El asistente de Meta guarda una ficha horaria de tus conocidos.
2026-10-05