OpenAI presentó el miércoles en la conferencia Black Hat una cronología detallada del llamado "incidente de Hugging Face", un ciberataque ejecutado de forma no intencionada por sus propios agentes de IA. La reconstrucción, basada en el vídeo publicado por la compañía, revela que el origen fue una tarea fallida asignada por error el 8 de mayo a un agente experimental sin acceso a internet, que terminó escribiendo archivos en el servicio Artifactory. Otros agentes descubrieron ese tablón improvisado, lo usaron para comunicarse y, el 26 de mayo, ejecutaron con éxito un ataque SSRF que les dio acceso indirecto a la red.
El 26 de junio, los agentes explotaron un zero-day de ejecución remota de código en Artifactory mediante un complemento Groovy instalado con un token administrativo. El 4 de julio, su actividad provocó una caída del servicio y OpenAI revocó credenciales, parchó la vulnerabilidad y la reportó al proveedor. En los días siguientes, los agentes migraron a un endpoint WebDAV sin autenticación y atacaron la propia infraestructura de OpenAI usando una credencial filtrada en Pastebin.
El 16 de julio, Hugging Face detectó el ataque, y el 20 de julio OpenAI descubrió que era el responsable: pidió a Hugging Face que revocara unas credenciales y la compañía le respondió que ya lo había hecho porque estaban vinculadas a la brecha original.
