OpenAI frena el desarrollo de su modelo Astra por problemas de seguridad informática
La empresa ha pausado parte del trabajo en su próximo modelo de inteligencia artificial tras detectar riesgos en sus capacidades para realizar ciberataques.

OpenAI ha suspendido temporalmente el desarrollo de algunas funciones de Astra, su próximo modelo de inteligencia artificial, después de detectar que podría tener capacidades avanzadas en ciberseguridad que la empresa considera peligrosas, según informó TechCrunch.
La compañía, creadora de ChatGPT (el chatbot conversacional más conocido del mercado), no ha detallado qué aspectos concretos del modelo ha paralizado, pero la decisión responde a preocupaciones internas sobre cómo Astra podría utilizarse para encontrar vulnerabilidades en sistemas informáticos o ejecutar ataques. Los modelos de lenguaje grandes o LLMs (sistemas de IA entrenados con enormes cantidades de texto para entender y generar lenguaje humano) cada vez son más capaces de escribir código, lo que los convierte en herramientas potencialmente útiles tanto para defenderse de hackers como para atacar.
Esta no es la primera vez que OpenAI retrasa el lanzamiento de un modelo por motivos de seguridad. En 2019, la empresa decidió no publicar inicialmente la versión completa de GPT-2 (un modelo anterior a GPT-3 y GPT-4) alegando que podría usarse para generar desinformación a gran escala. Sin embargo, aquella decisión generó críticas en la comunidad investigadora, que consideró la medida exagerada y poco transparente.
El caso de Astra llega en un momento de creciente debate sobre los riesgos de los modelos de IA más avanzados. Gobiernos de Estados Unidos y Europa están empezando a exigir que las empresas evalúen las capacidades peligrosas de sus sistemas antes de lanzarlos, especialmente en áreas como ciberseguridad, diseño de armas biológicas o manipulación de opinión pública.
OpenAI no ha confirmado cuándo podría reanudarse el desarrollo completo de Astra ni si el modelo llegará al mercado con limitaciones permanentes en sus funciones de seguridad informática. La empresa tampoco ha aclarado si estas capacidades aparecieron de forma inesperada durante el entrenamiento o si formaban parte del diseño original del modelo.


