Un grupo de investigadores de Hacktron AI logró infiltrarse en los sistemas de OpenAI y obtuvo una recompensa de 6.500 dólares tras demostrar acceso al código fuente privado. La cadena de ataque comenzó con la función de carga de imágenes del foro de ayuda, alimentado por Discourse. Un filtro de seguridad no reconoció ciertos formatos, permitiendo que archivos maliciosos alcanzaran una biblioteca de procesamiento de imágenes con una vulnerabilidad de corrupción de memoria conocida. Inicialmente, el modelo Claude de Anthropic no pudo sortear una medida de aleatorización de memoria, pero la versión más reciente generó código de exploit funcional y lo adaptó a la configuración del foro. Con el control del foro, los atacantes accedieron al sistema de inicio de sesión único de OpenAI, cuya credencial también autenticaba cuentas de ChatGPT y Codex. El incidente subraya la necesidad de auditorías rigurosas y de integrar controles de seguridad específicos para herramientas de IA generativa.