Crear
OpenAI dice que Astra alcanza un nivel crítico de ciberseguridad y puede explotar vulnerabilidades de día cero

OpenAI dice que Astra alcanza un nivel crítico de ciberseguridad y puede explotar vulnerabilidades de día cero

Arkadiy Andrienko

OpenAI afirma que su Astra modelo se ha convertido en el primer sistema que la compañía ha clasificado en su umbral de capacidad crítica de ciberseguridad bajo el Marco de Preparación. Se informa que el modelo no publicado puede identificar fallos de seguridad previamente desconocidos y convertirlos en exploits funcionales sin la guía paso a paso de un humano.

La empresa también dice que, con las herramientas y el acceso adecuados, Astra puede operar en sistemas altamente protegidos y llevar a cabo ataques sin que una persona dirija cada paso. En pruebas internas, Astra logró una puntuación perfecta del 100% en ExploitBench, que mide la capacidad de crear exploits a partir de vulnerabilidades conocidas. OpenAI dice que el modelo también descubrió y utilizó dos vulnerabilidades de día cero como parte de una cadena de exploits.

Comparación de los modelos Astra y GPT-5.6 SolComparación de los modelos Astra y GPT-5.6 Sol

La empresa dice que Astra fue más allá en otra prueba también: construyó una cadena de compromiso del navegador que escapó de la sandbox y ejecutó comandos en el host. OpenAI también dice que el modelo encontró múltiples vulnerabilidades en un sistema operativo endurecido y las combinó en una cadena de escalación de privilegios locales de un usuario no privilegiado a root.

Debido a estas capacidades, OpenAI dilató partes del desarrollo de Astra mientras fortalecía las protecciones contra el uso indebido cibernético y las acciones no autorizadas del modelo. La empresa dice que Astra ahora rechaza el 91.5% de las solicitudes cibernéticas no permitidas, en comparación con el 59% para GPT-5.6 Sol.

OpenAI planea hacer que Astra esté disponible pronto, pero el acceso a sus capacidades de ciberseguridad más avanzadas estará limitado al principio a un pequeño grupo de probadores alfa y luego a Daybreak Blue. "Es el primer modelo que estamos designando a este nivel.— OpenAI, desarrollador"

Si un modelo puede encontrar y explotar vulnerabilidades de día cero de manera independiente, ¿cuánto control es suficiente antes de que se libere?

    Sobre el autor
    Comentarios0