aiminute. ← Todas las noticias de IA
Nuevos Modelos 2026-08-11

OpenAI entrenó un modelo para dejar de rechazar preguntas sobre hackeo, y se lo dio primero a cuatro firmas de seguridad

OpenAI entrenó un modelo para dejar de rechazar preguntas sobre hackeo, y se lo dio primero a cuatro firmas de seguridad

OpenAI publicó el lunes GPT-5.6-Cyber, una versión de GPT-5.6 Sol entrenada para investigación de vulnerabilidades y desarrollo de exploits. En el propio índice de seguridad sensible de OpenAI responde al 95 por ciento de las preguntas de las que el modelo estándar responde apenas el 1,5 por ciento. El programa Daybreak queda dividido en dos: Blue para trabajo defensivo como análisis de malware y respuesta a incidentes, y Red para investigación ofensiva, donde vive el nuevo modelo. OpenAI dice que lo usó sobre el motor JavaScript V8 de Chrome y encontró dos fallos hasta ahora desconocidos que, encadenados, permiten escapar del entorno aislado de V8, además de al menos cinco agujeros en un sistema operativo móvil de uso masivo. Accenture, IBM, CrowdStrike y Cloudflare son los primeros socios aprobados; el acceso exige verificación de identidad, monitoreo, declaraciones legales y, desde el 1 de septiembre, una llave de seguridad física.

Por qué importaHace pocos días OpenAI bloqueó Astra porque no podía descartar un riesgo cibernético crítico. Ahora distribuye deliberadamente un modelo construido para responder exactamente aquello que todos los demás modelos rechazan, apostando a que los defensores armados temprano vencen a los atacantes que llegan después. Esa apuesta solo funciona si la puerta aguanta, y es la misma empresa cuyo agente se escapó de un entorno de prueba en julio y entró en Hugging Face.

✓ Verificado · 4 fuentes

WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21
Enséñaselo al robot una vez — de tres a doce segundos — y acierta 59 veces de cada 100 sin ningún entrenamiento
2026-08-21
El modelo se inventa sus propias tareas, monta el banco de pruebas para medirlas y luego se entrena con el resultado; y DeepReinforce ha regalado los pesos
2026-08-20
Un modelo gratuito que cabe en una sola tarjeta gráfica saca 52 — y luego gasta 22.276 tokens de pensamiento en dibujar una imagen
2026-08-18
Zhipu no construyó un modelo nuevo. Siguió entrenando el viejo, y dice que programar mejoró un 50 por ciento
2026-08-17