aiminute. ← Todas las noticias de IA
Herramientas 2026-08-10

Anthropic estudió a 1.053 programadores pulsando 'aprobar': detectaron el 13,6% de los comandos peligrosos — así que el 14 de agosto el volante pasa a la máquina

Anthropic estudió a 1.053 programadores pulsando 'aprobar': detectaron el 13,6% de los comandos peligrosos — así que el 14 de agosto el volante pasa a la máquina

Desde el 14 de agosto, Claude Code funcionará en modo automático por defecto para quien tenga plan Pro, Max o Team. El modo automático significa que el agente de programación deja de pedir permiso antes de cada escritura de archivo y cada comando de consola, y pasa en su lugar cada llamada a herramienta por un clasificador que bloquea todo lo irreversible, lo destructivo o lo que apunte fuera de tu máquina. Anthropic ha publicado las cifras que sostienen la decisión. En un estudio controlado con 1.053 probadores de pago, las personas que revisaban los avisos a mano detectaron el 13,6 por ciento de los comandos peligrosos que se les pusieron delante; el modo automático bloqueó el 89 por ciento. En sesiones reales de producción, el trabajo aprobado a mano contenía acciones dañinas no deseadas a más del doble de tasa que el trabajo en modo automático: 6,3 por ciento frente a 2,4 por ciento. La explicación cabe en un dato: los programadores aprueban el 97 por ciento de los avisos que se les muestran, lo cual no es revisar, es pulsar. Junto al cambio, Anthropic añadió reglas de denegación estricta contra la exfiltración de datos, verificación de si un git push va a un repositorio público o privado, comprobaciones del estado de git antes de operaciones destructivas, y filtrado de contenido externo en busca de inyección de instrucciones. Las acciones bloqueadas mandan a Claude a buscar una vía más segura; si se acumulan bloqueos, la sesión vuelve a preguntar. El coste en tokens del propio clasificador ya no se factura en esos tres planes. Enterprise, la API, Bedrock, Google Cloud y Microsoft Foundry siguen siendo opcionales por ahora, y Anthropic dice esperar hacerlo predeterminado también allí dentro de un mes.

Por qué importaLo interesante no es que una empresa haya lanzado un valor por defecto más autónomo. Es el argumento con que lo justifica, porque invierte el habitual. Los avisos de permiso existían para mantener a una persona en el circuito de decisión; la propia telemetría de Anthropic dice que esa persona es un sello de goma, y que una máquina leyendo los mismos comandos es unas seis veces mejor detectando los malos. Ese razonamiento se generaliza mucho más allá de un producto: cada cuadro de consentimiento, cada '¿estás seguro?', cada cola de aprobación en el software descansa en el supuesto de que si te preguntan, miras. Si usas Claude Code en un plan de pago, lo práctico es que tu valor por defecto cambia el 14 de agosto hayas leído o no el anuncio, y conviene decidir ahora en lugar de enterarte después: puedes fijar otro modo de permisos, y los administradores pueden fijarlo para todo un equipo. La salvedad honesta es que 89 por ciento no es 100, y ahora los fallos son silenciosos. Con el valor anterior, para que ocurriera un error hacía falta que tú pulsaras. Con el nuevo no hace falta nadie.
#Programación#Agentes IA

✓ Verificado · 4 fuentes

▶ Vídeo relacionado: How auto mode works with Claude Code
WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

Apple Music dirá cuándo una canción la hizo una máquina — pero quien la sube decide si lo declara
2026-08-21
Rumor: el modelo anónimo que acaba de encabezar un test de programación, gratis, sería el buque insignia sin publicar de Zhipu
2026-08-21
El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21
Nvidia paga 6.000 millones de dólares por la máquina que fabrica los modelos de un rival — y contrata a 109 de quienes la manejaban
2026-08-21
Stripe acaba de pagar 7.500 millones por un enrutador de modelos. Días después Ramp construyó uno y lo regala hasta enero.
2026-08-21