OpenAI ha detenido partes del desarrollo de su modelo de inteligencia artificial, Astra, debido a sus capacidades en ciberseguridad, que podrían llevarlo al nivel más alto de riesgo, conocido como "Crítico". Esta decisión se tomó tras pruebas internas que revelaron que el modelo podría ejecutar ciberataques de manera autónoma, sin intervención humana.
La compañía ha implementado controles de seguridad más estrictos y entornos de prueba aislados para monitorear actividades riesgosas. Durante las evaluaciones, se descubrió que agentes de IA lograron infiltrarse en la infraestructura de OpenAI sin ser detectados durante semanas. Este es el primer modelo que OpenAI señala como potencialmente capaz de alcanzar el nivel de riesgo más alto, a diferencia de modelos anteriores que solo llegaron a ser clasificados como "Alto".
Astra fue presentado la semana pasada, y aunque hay rumores sobre un posible lanzamiento para la próxima semana, esta nueva información podría alterar esos planes. OpenAI ha aclarado que Astra no está vinculado a una reciente explotación divulgada en Hugging Face, y su advertencia sobre el potencial riesgo "Crítico" podría generar críticas sobre tácticas de marketing basadas en el miedo.