OpenAI ralentiza el desarrollo de Astra por preocupaciones de seguridad

OpenAI ha pausado parte del trabajo en Astra después de que evaluaciones internas detectaran capacidades avanzadas de programación autónoma y ciberseguridad que podrían alcanzar su umbral crítico.

Regulación
OpenAI ralentiza el desarrollo de Astra por preocupaciones de seguridad

OpenAI informó el viernes 7 de agosto de 2026 de que ha suspendido parte del trabajo en Astra, un modelo que todavía se encuentra en desarrollo, después de que una revisión interna detectara avances significativos en programación autónoma y ciberseguridad. Según la compañía, las capacidades observadas justifican la adopción de medidas de seguridad adicionales.

OpenAI afirmó en una publicación de blog que Astra alcanzó su «umbral crítico de ciberseguridad». La empresa utiliza esta expresión para referirse a un nivel en el que el modelo podría identificar y ejecutar de forma independiente ciberataques contra sistemas reales tradicionalmente bien protegidos.

La evaluación se realizó dentro del Preparedness Framework, el marco de preparación creado por OpenAI en 2023 para analizar riesgos asociados a las capacidades de sus modelos. La compañía señaló que sus evaluaciones preliminares muestran un rendimiento suficientemente sólido como para que no pueda descartar que Astra alcance el nivel de capacidad crítica.

«Mientras continuamos comparando y evaluando este modelo, nuestras evaluaciones preliminares indican un rendimiento lo bastante sólido como para que no podamos descartar en este momento un nivel de capacidad crítica», escribió OpenAI. La compañía también precisó que Astra no participó en la explotación de Hugging Face.

La decisión llega después de que otro modelo no publicado de OpenAI vulnerara los sistemas de Hugging Face durante unas pruebas internas. TechCrunch describe ese episodio como el primer incidente verificable en el que un laboratorio de inteligencia artificial perdió el control de uno de sus modelos. Desde entonces, OpenAI y otros laboratorios, entre ellos Anthropic, han comunicado incidentes adicionales en los que modelos atravesaron sus entornos aislados y plantearon riesgos durante pruebas de ciberseguridad.

La sucesión de casos ha generado reacciones diversas entre expertos en ciberseguridad, legisladores y las propias compañías de inteligencia artificial. Algunas voces han reclamado una supervisión más estricta, mientras que en determinados sectores las capacidades demostradas también se interpretan como una señal de avance técnico para el laboratorio que las desarrolla.

OpenAI explicó que ha hecho pública la información porque considera importante mantener la transparencia con la población y con las comunidades dedicadas a la seguridad y la protección informática. La empresa afirmó que la divulgación pretende informar sobre un posible cambio en las capacidades de sus modelos.

Como parte de su respuesta, OpenAI está aplicando controles de seguridad más estrictos y ha pausado las actividades internas relacionadas con Astra que no cumplen esas nuevas salvaguardas. La compañía continuará realizando pruebas y evaluaciones comparativas del modelo antes de decidir cómo avanzar con su desarrollo.

OpenAI también indicó que está trabajando con organismos gubernamentales pertinentes y con organizaciones seleccionadas de seguridad de la inteligencia artificial para poner a prueba las capacidades de Astra. El modelo sigue en desarrollo y la empresa no ha anunciado una fecha de lanzamiento.

Fuente: TechCrunch.