OpenAI decidió pausar el desarrollo de Astra, su nueva IA que resultó ser demasiado peligrosa. Aunque el anuncio decepcionó a algunos que ya pensaban en el próximo ChatGPT, la empresa ha desplegado otro modelo que servirá para protegernos de hackeos. OpenAI confirmó que lanzará GPT-5.6-Cyber, una IA que se basa en uno de sus modelos más potentes y servirá para tareas de seguridad.
De acuerdo con una publicación en su blog, GPT-5.6-Cyber está construido sobre la base de GPT-5.6 Sol, aunque con una diferencia importante en su comportamiento. OpenAI señaló que redujo las restricciones que normalmente aplican a las tareas de doble uso relacionadas con la ciberseguridad. Esto permitirá que la IA pueda colaborar en investigaciones que quedaban bloqueadas por los sistemas de seguridad estándar.
OpenAI señala que, a medida que los modelos de IA se vuelven más hábiles para detectar y explotar vulnerabilidades de software, los equipos defensivos disponen de menos tiempo para anticiparse a ataques automatizados. Estos bloqueos fueron parte del motivo por el que Hugging Face usó modelos de código abierto cuando investigaba el origen del último hackeo, ya que ninguna de las IA más potentes consiguió avanzar por culpa de sus mecanismos de seguridad.
Según la empresa, GPT-5.6-Cyber ha conseguido una buena puntuación en el Advanced Cybersecurity Completion Rate, un benchmark que mide qué tan seguido una IA responde con éxito a solicitudes de seguridad de alto riesgo o avanzadas. El modelo completó el 95% de peticiones en tareas complejas como cadenas de exploits, evasión de autenticación o escalado de privilegios. Como referencia, GPT-5.5-Cyber apenas consiguió un 57,3%, mientras que la versión estándar de GPT-5.6 Sol alcanzó un 1,5% con sus salvaguardas habituales.
GPT-5.6-Cyber ya descubrió vulnerabilidades en Chrome
La compañía también compartió resultados del desempeño de su nuevo modelo en investigaciones reales. GPT-5.6-Cyber ayudó a descubrir dos vulnerabilidades en el motor V8 de Chrome, las cuales podían encadenarse para corromper memoria y escapar del entorno aislado del navegador. El modelo también contribuyó a identificar otros fallos en sistemas operativos de escritorio, dispositivos móviles y bases de datos.
Al igual que vimos con su predecesor, el acceso a GPT-5.6-Cyber estará limitado a investigadores de seguridad y equipos de defensa, aunque con un ajuste. OpenAI reorganizó su programa Daybreak en dos categorías: Blue y Red. La primera permite acceder a los modelos más potentes, incluyendo GPT-5.6 Sol, pero con salvaguardas ajustadas para permitir trabajo de seguridad.
Los que se encuentren en el programa Daybreak Blue podrán revisar código, realizar análisis de malware, responder a incidentes de seguridad y validar parches. Por otro lado, Daybreak Red dará acceso a modelos más especializados y con un control más estricto, como GPT-5.6-Cyber. Este programa permite buscar vulnerabilidades de día cero, desarrollar cadenas de exploit completas y llevar a cabo pruebas de seguridad ofensivas.
El acceso a Daybreak Red se limita a unos cuantos socios, entre los que se encuentran Accenture, IBM, Capgemini, Cognizant, EY, KPMG, PwC, NCC Group y SpecterOps. En la lista también se encuentran proveedores de seguridad como Palo Alto Networks, CrowdStrike, Cisco, Sophos, Akamai, Fortinet y Cloudflare. Estos últimos integrarán el modelo en sus productos y servicios, sin transferir el acceso a terceros.
OpenAI dijo que este esquema permite que las organizaciones se beneficien de las capacidades de su modelo sin tener que construir su propia infraestructura.
Seguir leyendo: La nueva IA de ChatGPT ya encuentra fallos de seguridad antes que los hackers




