OpenAI amplía su programa Daybreak con dos niveles de acceso para defensores autorizados y presenta GPT-5.6-Cyber, un modelo especializado en investigación de vulnerabilidades, validación de exploits y pruebas de seguridad. La iniciativa llega en un momento en que la inteligencia artificial puede acelerar los ataques y reducir el tiempo de preparación de las organizaciones.
Dos niveles para la defensa cibernética
La propuesta de OpenAI busca poner modelos avanzados en manos de equipos que realizan trabajo de seguridad legítimo. La compañía divide el acceso en dos opciones:
- Daybreak Blue: ofrece modelos generales de frontera, incluido GPT-5.6 Sol, con protecciones adaptadas a tareas defensivas autorizadas. Está pensado como punto de partida para la mayoría de los equipos.
- Daybreak Red: incorpora modelos entrenados específicamente para investigación avanzada de vulnerabilidades, validación de exploits y pruebas de seguridad autorizadas.
Daybreak Blue puede utilizarse en actividades como revisión segura de código, análisis de malware, respuesta a incidentes, gestión de vulnerabilidades, investigación y validación de parches. ¿Por qué separar los accesos? Porque no todos los equipos necesitan el mismo nivel de capacidad ni enfrentan los mismos riesgos.
GPT-5.6-Cyber reduce las negativas en tareas avanzadas
GPT-5.6-Cyber está disponible mediante Daybreak Red y se basa en GPT-5.6 Sol. OpenAI lo entrenó para mejorar tareas especializadas, como la búsqueda de vulnerabilidades de día cero, el desarrollo de cadenas de explotación y la evaluación técnica de fallos.
La diferencia principal no es solo que el modelo pueda resolver problemas más complejos. También está diseñado para rechazar menos solicitudes relacionadas con actividades de doble uso, siempre dentro de un entorno de acceso restringido para investigadores y organizaciones aprobadas.
Según una evaluación interna de OpenAI llamada Advanced Cybersecurity Completion Rate, GPT-5.6-Cyber completó el 95 % de solicitudes avanzadas evaluadas. GPT-5.6 Sol alcanzó el 1,5 % con sus protecciones generales y el 2 % mediante Daybreak Blue. GPT-5.5-Cyber llegó al 57,3 %.
Estos números deben leerse con contexto: son resultados de pruebas internas y no equivalen por sí solos a una medida universal de seguridad o eficacia. Además, OpenAI señala que GPT-5.6-Cyber utiliza un presupuesto de razonamiento más amplio, lo que puede aumentar el consumo de tokens.
Resultados mixtos en las pruebas de seguridad
En ExploitGym, una evaluación que mide si un agente puede convertir vulnerabilidades conocidas en exploits funcionales dentro de entornos controlados, GPT-5.6-Cyber superó a GPT-5.6 Sol y GPT-5.5-Cyber.
También obtuvo mejores resultados que GPT-5.6 Sol en una prueba interna sobre vulnerabilidades de día cero. En ese escenario, los modelos debían analizar repositorios de código, crear pruebas de concepto y explicar el impacto técnico de sus hallazgos.
Sin embargo, no ganó en todas las evaluaciones. En una prueba de descubrimiento y redacción de vulnerabilidades, GPT-5.6 Sol tuvo un mejor desempeño. OpenAI atribuye parte de la diferencia a que GPT-5.6-Cyber produce, en ocasiones, informes más breves y menos detallados.
En ExploitBench, que evalúa la creación de exploits para vulnerabilidades de V8 con menos información y más protecciones activas, GPT-5.6 Sol fue más eficiente en el escenario estándar de 300 turnos. Cuando el límite aumentó a 600 turnos, la diferencia entre ambos modelos se redujo.
La conclusión no es que un modelo sea superior en todo. Cada sistema parece destacar según el tipo de investigación, el nivel de contexto y el tiempo disponible.
Vulnerabilidades encontradas en software real
OpenAI afirma que utilizó GPT-5.6-Cyber para estudiar proyectos de software reales, incluido V8, el motor de JavaScript utilizado por Chrome. La investigación identificó dos vulnerabilidades que podían encadenarse para corromper memoria y escapar del aislamiento del heap de V8.
Los investigadores validaron los hallazgos y los comunicaron a Google mediante divulgación coordinada. Una de las vulnerabilidades recibió el identificador CVE-2026-15903 y fue clasificada como de alta gravedad.
De acuerdo con la descripción publicada por OpenAI, el compilador optimizador de V8 omitía una comprobación de seguridad al convertir ciertos valores en enteros. Esto podía generar un índice de matriz inesperadamente grande y permitir lecturas o escrituras fuera de los límites previstos. En determinadas condiciones, el problema podía contribuir a la ejecución de código dentro del entorno aislado de Chrome.
La compañía también asegura haber encontrado vulnerabilidades de alta gravedad en un sistema operativo móvil, una base de datos popular y un núcleo de sistema operativo. Entre los resultados mencionados hay una cadena que podría llevar desde una aplicación no confiable hasta una escalada local de privilegios, tres fallos críticos en una base de datos y más de 400 vulnerabilidades relacionadas con escalada de privilegios en un kernel.
OpenAI indica que trabaja con sus socios de Daybreak y la comunidad de código abierto para divulgar y corregir estos problemas. La utilidad más importante de estos sistemas, en este contexto, no está en producir ataques, sino en ayudar a descubrir fallos antes de que sean aprovechados.
El modelo sigue por debajo del umbral crítico
Dentro de su Preparedness Framework, OpenAI clasificó a GPT-5.6 Sol como High en capacidad de ciberseguridad, pero por debajo del nivel Critical. GPT-5.6-Cyber también alcanzó el umbral High sin llegar a Critical.
Esto significa que el modelo mejora en tareas para las que fue entrenado específicamente, pero la propia compañía no considera que haya alcanzado un nivel crítico de capacidad cibernética. OpenAI también aclara que GPT-5.6-Cyber no estuvo involucrado en la explotación del incidente de Hugging Face mencionado en su actualización y que no hay otros modelos previstos para una próxima versión relacionados con ese caso.
La empresa asegura que publicará un informe técnico o system card con evaluaciones adicionales más adelante.
Acceso restringido y controles adicionales
Daybreak Blue y Daybreak Red están disponibles para personas y organizaciones aprobadas que realicen trabajo autorizado. El acceso incluye verificación de identidad, controles de seguridad de cuentas, monitoreo, restricciones de uso y declaraciones legales sobre el propósito de las actividades.
OpenAI también anunció varias medidas adicionales:
- Recomienda utilizar el modo de revisión automática en Codex en lugar del modo de acceso completo. Este sistema revisa acciones que requieren permisos elevados antes de ejecutarlas.
- Exigirá llaves de seguridad físicas para todas las cuentas individuales de Daybreak a partir del 1 de septiembre de 2026.
- Planea incorporar mejoras de monitoreo durante las semanas siguientes.
- Dará prioridad al entrenamiento y las pruebas de alineación en futuras versiones de Daybreak.
- Actualizó su documentación de Codex con prácticas para mantener los agentes dentro de los límites de seguridad definidos.
Entre las recomendaciones de uso están ejecutar los flujos de trabajo en entornos aislados, evitar el acceso directo a sistemas de producción sensibles, supervisar las acciones del agente y definir con precisión qué sistemas y operaciones están autorizados.
Las organizaciones también pueden personalizar sus políticas de revisión para adaptar los controles a sus procesos internos. Para la mayoría de los defensores, OpenAI recomienda comenzar con Daybreak Blue. Los equipos que trabajan con investigación avanzada de vulnerabilidades, desarrollo de exploits o ejercicios de red team pueden solicitar acceso a Daybreak Red.
La carrera entre atacantes y defensores con inteligencia artificial ya no es una preocupación lejana. La pregunta práctica es cómo entregar capacidades potentes sin convertirlas en una puerta abierta para el abuso. OpenAI apuesta por el acceso restringido, los entornos controlados y la supervisión humana, pero la eficacia de ese modelo dependerá de que los controles evolucionen tan rápido como las capacidades técnicas.
Fuente original
https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows
