OpenAI amplía Daybreak y lanza GPT-5.6-Ciber para reforzar a los defensores

Fuentes: Expanding Daybreak as the Cyber Defense Window Narrows, 20minutos.esT3clickbait

OpenAI ha anunciado la ampliación de su programa Daybreak y el lanzamiento de GPT-5.6-Cyber, un modelo de inteligencia artificial específicamente entrenado para tareas avanzadas de ciberseguridad, con el objetivo declarado de reforzar las capacidades de los equipos defensores antes de que los atacantes desplieguen herramientas ofensivas basadas en IA a gran escala.

La compañía parte de un diagnóstico preocupante: los actores maliciosos utilizan cada vez más la inteligencia artificial para ejecutar ciberataques a una velocidad y escala sin precedentes, incluyendo modalidades plenamente autónomas. Ante este escenario, OpenAI afirma que los defensores cuentan con una "ventana de tiempo" cada vez más estrecha para prepararse, y su respuesta es poner la inteligencia artificial de frontera en manos de profesionales autorizados.

El programa Daybreak se estructura ahora en dos niveles de acceso. Daybreak Blue ofrece acceso a modelos de uso general de frontera, incluido GPT-5.6 Sol, con medidas de seguridad adaptadas al trabajo defensivo autorizado, abarcando desde descubrimiento de vulnerabilidades y revisión de código hasta respuesta a incidentes y validación de parches. Daybreak Red, el nivel superior, proporciona acceso a modelos específicamente entrenados para investigación de vulnerabilidades, validación de exploits y pruebas de seguridad.

La principal novedad es GPT-5.6-Cyber, disponible exclusivamente a través de Daybreak Red. Construido sobre GPT-5.6 Sol, ha sido entrenado para mejorar el rendimiento en tareas especializadas como la localización de vulnerabilidades zero-day y el desarrollo de cadenas de exploits, al tiempo que reduce las negativas del modelo en escenarios de uso dual. Según la evaluación interna Advanced Cybersecurity Completion Rate de OpenAI, GPT-5.6-Cyber completa el 95% de las solicitudes sobre desarrollo de cadenas de exploits, bypass de autenticación y escalada de privilegios, frente a apenas el 1,5% de GPT-5.6 Sol y el 2% cuando se usa con acceso Daybreak Blue. También supera a su predecesor, GPT-5.5-Cyber, que completaba el 57,3% de las peticiones.

En pruebas comparativas, el modelo demuestra avances notables. En ExploitGym, que evalúa la capacidad de los agentes para convertir vulnerabilidades conocidas en exploits funcionales, GPT-5.6-Cyber supera tanto a GPT-5.6 Sol como a GPT-5.5-Cyber. En la evaluación interna de descubrimiento de vulnerabilidades y redacción de informes, tanto GPT-5.6 Sol como GPT-5.6-Cyber mejoran respecto a la generación anterior, aunque GPT-5.6-Cyber produce en ocasiones informes más breves. En ExploitBench, con un límite estándar de 300 turnos, GPT-5.6 Sol con Daybreak Blue ofrece mejor eficiencia; al ampliar a 600 turnos, la brecha se reduce.

Más allá de los benchmarks, OpenAI destaca aplicaciones en el mundo real. Investigadores de la compañía utilizaron GPT-5.6-Cyber para analizar el motor V8 de Chrome y descubrieron dos vulnerabilidades previamente desconocidas que podrían encadenarse para corromper memoria y escapar del sandbox de V8, hallazgos que fueron reportados a Google mediante un proceso de divulgación coordinada. Socios comerciales con acceso anticipado han confirmado que el modelo acelera flujos de trabajo de investigación de vulnerabilidades, resolviendo tareas en menos de un día que antes requerían semanas.

El anuncio llega en un contexto de creciente debate sobre el equilibrio entre el potencial defensivo y el riesgo de uso indebido de la IA en ciberseguridad. Al relajar las restricciones para usuarios autorizados mientras se mantienen filtros para el público general, OpenAI adopta un modelo de acceso por niveles que ya aplican otros actores del sector. La estrategia plantea interrogantes sobre los criterios de selección de los "defensores de confianza" y sobre si la reducción de negativas en tareas de uso dual podría, en última instancia, facilitar también a los atacantes si el control de acceso fallara.

Por ahora, GPT-5.6-Cyber y los nuevos niveles de Daybreak marcan un paso significativo en la profesionalización de la IA aplicada a la ciberseguridad, aunque el verdadero termómetro será su adopción por parte de equipos azules, su impacto en los tiempos de respuesta a vulnerabilidades y la evolución de las amenazas autónomas que la propia compañía señala como motor de esta iniciativa.