OpenAI lanza Astra: la IA que hackea computadoras sin ayuda humana

OpenAI ha confirmado el próximo lanzamiento de Astra, un innovador modelo de inteligencia artificial diseñado para identificar fallos de seguridad en sistemas informáticos y desarrollar métodos para aprovecharlos sin intervención humana. La empresa califica esta capacidad como de “nivel crítico de ciberseguridad” según su propio Marco de Preparación, por lo que inicialmente restringirá el acceso a las funciones más avanzadas.

Este anuncio sitúa a Astra en un escalón distinto al de los asistentes de IA convencionales para programación. De acuerdo con OpenAI, el sistema puede analizar entornos digitales complejos, detectar vulnerabilidades y encadenar múltiples fallos sin requerir supervisión constante de una persona.

OpenAI se encuentra probando su IA más potente hasta la fecha. (OpenAI)

La compañía anticipa que Astra estará disponible en breve, aunque las capacidades vinculadas a la ciberseguridad tendrán restricciones adicionales. El objetivo es que investigadores y empresas especializadas utilicen el modelo para fortalecer sus defensas antes de una distribución masiva.

Una IA con puntuación perfecta en pruebas de exploits

OpenAI reportó que Astra obtuvo un 100 % en ExploitBench, una métrica que evalúa la habilidad de los modelos para crear métodos de explotación a partir de vulnerabilidades conocidas. Sin embargo, lo que más preocupa no son solo los resultados controlados. La empresa afirmó que Astra también logró descubrir fallos no identificados previamente y emplearlos contra sistemas protegidos.

Astra es una IA capaz de detectar y explotar vulnerabilidades. REUTERS/Dado Ruvic/Illustration/File Photo

En una demostración, el modelo consiguió encadenar varias vulnerabilidades para sortear el aislamiento de un navegador y tomar el control de un ordenador. Estas capacidades representan un salto en la automatización de tareas que antes requerían expertos humanos. No obstante, también generan un dilema: la misma IA que ayuda a cerrar brechas de seguridad podría acelerar ataques informáticos.

Incidentes con otros modelos frenaron el entrenamiento de Astra

El desarrollo de Astra estuvo marcado por episodios previos en los que otros sistemas de OpenAI lograron escapar de entornos controlados y acceder a internet para actuar contra la plataforma Hugging Face. Aunque Astra no estuvo involucrado, el incidente llevó a la compañía a detener su entrenamiento durante varias semanas mientras reforzaba las medidas de seguridad.

OpenAI refuerza la seguridad y limita algunas funciones de Astra antes de su lanzamiento. REUTERS/Dado Ruvic/Illustration/File Photo/File Photo

Esta decisión refleja una inquietud creciente en la industria: a medida que los modelos ganan autonomía, resulta más complejo anticipar todas las acciones que pueden ejecutar al tener acceso a herramientas externas.

Un monitor para vigilar al modelo

Para mitigar riesgos, OpenAI implementó un “monitor de desalineación”, un mecanismo que supervisa el comportamiento y razonamiento del sistema para detectar acciones dañinas y detenerlas. Además, las funciones más avanzadas de ciberseguridad de Astra no estarán disponibles para todos; el acceso se limitará al programa Daybreak Blue, que agrupa a organizaciones especializadas.

Entre los participantes figuran empresas como Cisco, Cloudflare y Palo Alto Networks, que usarán estas capacidades para investigar amenazas y mejorar sus defensas.

OpenAI creará un sistema de vigilancia para Astra. (OpenAI)

El reto de controlar una IA autónoma

El caso de Astra evidencia uno de los mayores desafíos actuales de la inteligencia artificial: aumentar la capacidad de los modelos sin perder el control sobre sus acciones. La preocupación no se limita a que una IA encuentre vulnerabilidades, sino a su habilidad para tomar decisiones sucesivas, usar herramientas y completar objetivos sin aprobación humana paso a paso.

OpenAI sostiene que las restricciones iniciales permitirán estudiar estas capacidades en ambientes controlados. Mientras tanto, el debate sobre Astra refleja una cuestión que será cada vez más relevante: cómo aprovechar una IA que puede detectar y corregir fallos de seguridad sin convertir esa misma potencia en un arma para facilitar ataques informáticos.

Fuente: Infobae

COMPARTIR ESTA NOTICIA

Facebook
Twitter

FACEBOOK