Twitch entrenará por defecto la IA de Amazon con el contenido de los streamers

Fuentes: Amazon will train on Twitch streamers' content by default, unless they opt out, wired.com

Twitch, la principal plataforma de streaming en vivo del mundo, ha activado por defecto una opción que permite a Amazon, su empresa matriz, utilizar el contenido de los streamers —incluidos audios, videos y transmisiones en directo— para entrenar sus modelos de inteligencia artificial generativa. El cambio, comunicado a través de una nueva configuración en la sección de seguridad y privacidad de cada cuenta, ha desatado una ola de críticas entre los creadores de contenido, quienes consideran que la decisión se tomó sin su consentimiento y que deberían ser ellos quienes autoricen explícitamente el uso de su material.

La medida fue presentada por Twitch como una concesión a la comunidad: una opción para desactivar el uso del contenido en el entrenamiento de IA. Sin embargo, la lógica inversa —estar incluidos por defecto— es lo que ha generado mayor indignación. En un livestream en el canal oficial de Twitch, al que asistieron cerca de 3.000 espectadores, Mike Minton, director de producto de la plataforma, reconoció con crudeza el motivo de esta decisión: "Si esto fuera opt-in, nadieoptaría por entrar. Esa es la verdad". Minton añadió que es "razonable asumir que casi cualquier contenido disponible públicamente se utiliza para entrenar modelos, con o sin permiso", sugiriendo que otras empresas tecnológicas probablemente ya están extrayendo datos de Twitch con fines similares.

Por su parte, Mary Kish, jefa de comunidad de Twitch, intentó justificar la inclusión de la opción de exclusión como un reflejo de la voluntad de la plataforma de escuchar a sus usuarios, aunque admitió que la reacción negativa era esperada. La ejecutiva comparó la práctica con la de Meta, que también emplea contenido público de Facebook e Instagram para entrenar sus sistemas de IA, recordando que los usuarios europeos pueden oponerse, algo que no ocurre en la mayoría de los países.

Uno de los puntos más sensibles del anuncio es la falta de claridad sobre desde cuándo Amazon comenzó a utilizar las transmisiones de los creadores para entrenar sus modelos. Cuando un usuario preguntó en el chat si sus videos ya habían sido utilizados, Minton respondió: "No sé la respuesta porque no sé qué ha hecho Amazon en términos de entrenamiento de modelos". Esta incertidumbre ha alimentado la sensación de que los datos de los streamers pudieron haber sido explotados antes de que pudieran ejercer cualquier tipo de control. Más de 16.000 creadores firmaron una petición en el foro de sugerencias de Twitch manifestándose en contra de la política.

Según Wired, los Términos de Servicio de Twitch, vigentes desde marzo de 2024, ya concedían a la plataforma y sus sublicenciatarios derechos amplios sobre el contenido de los usuarios, incluyendo reproducción, modificación y creación de obras derivadas. Sin embargo, nunca se había mencionado de forma explícita que ese material pudiera destinarse al entrenamiento de inteligencia artificial generativa. La nueva configuración tampoco impide que Twitch y Amazon empleen el contenido de los canales para otras funciones impulsadas por IA, como asistentes en tiempo real para campañas de patrocinio, sistemas de recomendación de audiencia o herramientas de moderación como AutoMod.

El episodio pone de relieve uno de los grandes desafíos que enfrenta la industria tecnológica: la creciente escasez de datos de alta calidad para entrenar modelos de IA. Para Amazon, acceder a miles de horas de audio y video producidos por streamers —muchos de los cuales graban sus voces y rostros durante decenas de horas semanales— representa un activo enormemente valioso. Para los creadores, en cambio, supone la posibilidad de que su imagen, voz y estilo sean replicados o replicables sin compensación ni control.

Por ahora, los streamers que deseen proteger su contenido pueden desactivar la opción accediendo a la configuración de su canal, seleccionando la pestaña de seguridad y privacidad y desactivando el interruptor de "entrenamiento para IA generativa". No obstante, la pregunta de fondo sigue abierta: ¿de quién es realmente el contenido que se transmite en directo en internet? El caso de Twitch probablemente sentará precedente en un debate que apenas comienza y que enfrenta a creadores, plataformas y desarrolladores de inteligencia artificial en todo el mundo.