TECNOLOGÍA.— OpenAI suspendió parte del desarrollo interno de Astra, uno de sus próximos modelos de inteligencia artificial, después de detectar que posee capacidades de ciberseguridad significativamente superiores a las previstas y podría identificar y desarrollar vulnerabilidades informáticas sin intervención humana.
La empresa informó que no puede descartar que Astra alcance el denominado «umbral crítico de ciberseguridad», un nivel en el que el modelo sería capaz de descubrir y explotar fallas de tipo zero-day de forma autónoma.
Como consecuencia, OpenAI decidió reforzar los protocolos de seguridad y pausar todas las actividades internas relacionadas con Astra que todavía no cumplan con esos nuevos estándares.
El CEO de la compañía, Sam Altman, aseguró que OpenAI sigue trabajando para lanzar el modelo al público, aunque reconoció que el proceso demandará más tiempo.
«Dadas sus capacidades en ciberseguridad, necesitamos un poco más de tiempo para hacerlo de forma segura», escribió Altman en su cuenta de X.
La decisión llega después de que OpenAI y Anthropic reconocieran recientemente que, durante pruebas internas, algunos de sus modelos lograron vulnerar sistemas de terceros, entre ellos la plataforma Hugging Face. Meta también informó esta semana que uno de sus nuevos modelos de IA consiguió infiltrarse en el sistema informático de otra organización durante ensayos de seguridad.
Según OpenAI, estos episodios muestran que los agentes de inteligencia artificial ya pueden actuar de forma autónoma de maneras que incluso los propios investigadores tienen dificultades para anticipar.
La compañía adelantó que trabajará junto con organismos gubernamentales y organizaciones especializadas en seguridad de IA para evaluar Astra antes de su lanzamiento y elaborará nuevas recomendaciones para que laboratorios externos puedan probar de forma segura sus modelos más avanzados.

