OpenAI dice que su nueva IA 'Astra' puede generar ciberataques sin asistencia humana

📅 2026-09-02

Resumen:

OpenAI dijo que su próximo modelo Astra puede descubrir vulnerabilidades de software previamente desconocidas y convertirlas en código de explotación que puede llevar a cabo ataques sin la necesidad de una guía humana paso a paso, lo que indica que el modelo ha cruzado un umbral en capacidades de ciberseguridad que anteriormente habían sido principalmente dominio de los mejores equipos de piratería.

La compañía dijo en una publicación de blog el martes que el Astra es el primer modelo clasificado con capacidades de red de nivel "crítico" en su "marco de preparación".

Para alcanzar este nivel, los modelos deben ser capaces de descubrir vulnerabilidades de software previamente desconocidas (es decir, vulnerabilidades de día cero) sin intervención humana y desarrollar ataques utilizables contra sistemas reales reforzados, o diseñar y ejecutar ataques basados ​​únicamente en objetivos de alto nivel.

En las pruebas, Astra logró una puntuación del 100% en una prueba comparativa que explotó vulnerabilidades conocidas y descubrió dos vulnerabilidades previamente desconocidas mientras construía una cadena de ataque en otra prueba interna.

En una prueba diseñada para ver si un modelo haría "trampa" en tareas de piratería extremadamente difíciles o imposibles, era más probable que GPT-5.6 Sol tomara atajos prohibidos, mientras que Astra no, y al mismo tiempo resolvió algunas tareas legalmente.

OpenAI también dijo que Astra rompió con éxito el entorno limitado del navegador y ejecutó comandos en la computadora host; Además, descubrió y combinó múltiples vulnerabilidades en el sistema operativo para obtener privilegios de root.

Posteriormente, la compañía retrasó el desarrollo de algunas características de Astra mientras agregaba salvaguardas de seguridad y planea abrir inicialmente sus capacidades de ciberseguridad más avanzadas solo a evaluadores seleccionados.

Esta capacidad es particularmente relevante para el espacio de las criptomonedas, ya que un error de software puede convertirse en ganancias reales en cuestión de minutos. Según los informes, un análisis realizado en junio de este año señaló que los modelos de IA cada vez más potentes pueden comprimir el proceso de búsqueda de código, descubrir configuraciones erróneas y ensamblar ataques de días o semanas a operaciones a velocidad de máquina.

En ese momento, los investigadores de seguridad dijeron que el cambio más importante no sería necesariamente tipos de ataques completamente nuevos, sino que la velocidad a la que se encontrarían y explotarían las debilidades existentes aumentaría significativamente.

Este desarrollo también muestra que los modelos de vanguardia están yendo más allá de "responder preguntas" y "escribir código". En julio de este año, un sistema de inteligencia artificial llamado Claude Fable 5 ayudó a resolver un acertijo matemático de 87 años.

Etiquetas relacionadas

Artículos relacionados

Comentarios

0/500
Captcha (click to refresh)
Sin comentarios