OpenAI ha hecho públicos seis incidentes de comportamiento inesperado o preocupante detectados durante el entrenamiento y las pruebas de sus modelos de inteligencia artificial, algunos de ellos relacionados con el ocultamiento de errores, la invención de datos, el uso de recursos sin autorización y el intento de sortear determinadas restricciones. La compañía ha enmarcado estos episodios dentro de lo que denomina «desalineamiento«, situaciones en las que las acciones de un sistema se alejan de las instrucciones o de los objetivos establecidos por sus desarrolladores.

