Scraper que robó 12 millones de obras de Cara colaborará con la plataforma en una herramienta para proteger a artistas

Fuentes: He Scraped All of Their Art for AI. Now He’s Collaborating on a Tool to Help Them

La aplicación Cara, refugio de unos 1,5 millones de artistas que buscan evitar que sus obras se usen sin permiso para entrenar inteligencia artificial, sufrió en agosto tres grandes episodios de scraping. El primero, ejecutado por el usuario de Reddit MandarinDawnPoppy994 —estudiante estadounidense que firma como "Heft"—, extrajo 12 terabytes con alrededor de 12 millones de imágenes y los publicó en r/DefendingAIArt, un proceso que costó menos de 10 dólares y que desató una oleada de ataques imitadores. El segundo scraper, "CaptiveDreamer", subió a Hugging Face unos 8,5 millones de enlaces y metadatos de usuarios; la plataforma retiró los datos personales pero mantuvo los enlaces argumentando que no albergan copias de las obras. El tercero, el 22 de agosto, difundió 123.000 imágenes y datos personales en Academic Torrents. Jingna Zhang, fundadora de Cara, lanzó un GoFundMe con una meta de 120.000 dólares para gastos legales y ha recaudado más de 100.000. Tras conocer el impacto emocional de su acción en los artistas, Heft se disculpó, eliminó su archivo y aceptó trabajar con Zhang en una nueva herramienta de código abierto para reforzar la protección de los creadores. Zhang, que forma parte de dos demandas colectivas contra Stability AI, Midjourney y Google por el uso no autorizado de obras para entrenar modelos, advierte de que ninguna plataforma puede garantizar seguridad total frente al scraping.