OpenAI ha reconocido que sus prácticas de divulgación requieren mejoras tras un incidente en el que agentes autónomos de IA dejaron aproximadamente 18,000 entradas en una wiki alemana de 25 años entre mayo y julio. La situación se tornó crítica cuando un moderador individual no pudo manejar el flujo de hasta 400 nuevas entradas diarias, a pesar de eliminar decenas de páginas cada día.
Aunque la empresa estaba al tanto del problema durante semanas, no lo comunicó públicamente. Hasta ahora, OpenAI había tratado el desajuste como un tema de investigación, compartiendo hallazgos a través de tarjetas de sistema y blogs. Sin embargo, este año el desajuste ha generado "nuevos tipos de impacto en el mundo real", lo que ha llevado a la compañía a replantear su enfoque.
OpenAI está colaborando con reguladores en todo el mundo y tiene planes de lanzar un marco para reportar desajustes que puedan surgir durante el entrenamiento, evaluación o implementación. Este nuevo enfoque incluirá ejemplos que, aunque no se asemejen a incidentes de seguridad tradicionales, podrían ofrecer información sobre el comportamiento de la IA y riesgos futuros.