Los streams y clips de Twitch se utilizan en el entrenamiento de la IA de Amazon: activa la prohibición en la configuración

25 agosto 202618 vistas

Twitch comenzó a dar a los usuarios la posibilidad de desactivar el uso de sus videos y publicaciones para entrenar los modelos de IA de la empresa matriz. La nueva opción ha generado preguntas entre los streamers: antes, su contenido podía entrar automáticamente en el conjunto de entrenamiento, y la negativa solo era posible de forma manual.

Los streams y clips de Twitch se utilizan en el entrenamiento de la IA de Amazon: activa la prohibición en la configuración

Twitch ha añadido a los streamers la posibilidad de prohibir que Amazon use sus vídeos y transmisiones para entrenar redes neuronales. La nueva opción apareció en la configuración de la cuenta, pero no se descubrió de inmediato: muchos creadores de contenido se enteraron solo después de empezar a revisar los cambios. La situación destapó una práctica antigua de la que la plataforma prefería no hablar directamente.

Cómo desactivar la cesión de contenido para el entrenamiento de IA

Para prohibir que tus streams y clips se usen para entrenar los modelos de Amazon, tienes que entrar en la configuración del perfil. En la aplicación o en la web de Twitch basta con abrir el avatar y, a continuación, ir a Settings, elegir la sección Security and Privacy y buscar el apartado Generative AI Training. Solo queda desactivar el interruptor y el contenido dejará de usarse para estos fines.

Es importante entender que desactivarlo no afecta a otras funciones de la plataforma. Como se indica en la explicación junto al interruptor, Twitch y Amazon pueden seguir utilizando los materiales de los creadores para otras tareas descritas en el Privacy Notice. Entre ellas están las sugerencias para integraciones de patrocinios, las recomendaciones personalizadas para los espectadores y el filtrado automático del chat. Es decir, la opción limita de forma puntual solo a los modelos generativos de IA, no a todo el análisis de datos de los usuarios.

Por qué ha generado polémica

La aparición de esta opción es un reconocimiento de que antes el contenido de los streamers se usaba sin un consentimiento explícito. Más de 16 000 creadores han mostrado su rechazo: no quieren que sus obras se conviertan por defecto en material de entrenamiento para la IA. La indignación aumentó tras un directo en el que la jefa de la comunidad de Twitch, Mary Kish, explicaba las novedades. Reconoció que esperaba una reacción negativa, y no se equivocó.

El responsable de producto de Twitch, Mike Minton, respondió que la opción activada por defecto era necesaria: de lo contrario, según sus palabras, «nadie participaría» en el proceso. Añadió que esta práctica no es exclusiva de Twitch. Minton sugirió que casi cualquier contenido disponible públicamente se usa de un modo u otro para entrenar modelos, con permiso de los autores o sin él, y que gran parte ocurre fuera del control de la plataforma.

Preguntas que siguen sin respuesta

Los streamers quieren saber cuándo empezó exactamente Twitch a ceder datos a Amazon. En el acuerdo de usuario vigente desde marzo de 2024 ya se contemplaba la posibilidad de usar, modificar y distribuir el contenido, así como crear obras derivadas a partir de él. Sin embargo, no se mencionaba explícitamente el entrenamiento de modelos generativos de IA. Ahora los creadores dudan de que puedan controlar por completo el uso de sus materiales y se preguntan quién más tiene acceso a ellos.

No está claro si Amazon es la única empresa que recibe datos de Twitch o si también participan socios externos. Tampoco hay información sobre si se tiene en cuenta la autoría en ese entrenamiento ni si los streamers pueden esperar una compensación. De momento, la plataforma no ha dado respuestas claras.

Un panorama más amplio: a todos les faltan datos

La historia de Twitch es solo un ejemplo de la creciente competencia por datos de calidad para la IA. Las grandes empresas buscan nuevas fuentes de contenido por todas partes. OpenAI, por ejemplo, firma acuerdos con editores, incluido Condé Nast. Meta ha utilizado publicaciones y fotos de usuarios de Facebook e Instagram para entrenar sus modelos, así como correos de empleados e imágenes de sus gafas inteligentes. Casos similares se han documentado también en Google con YouTube.

Los datos de alta calidad se han convertido en un recurso estratégico al mismo nivel que los chips, la memoria y la electricidad. A los principales desarrolladores de IA les faltan de forma crítica, por lo que se ven obligados a recurrir al contenido público, a veces sin avisar siquiera a los autores. El caso de Twitch demuestra que los usuarios exigen cada vez más transparencia y voz en este proceso, y las plataformas tienen que reaccionar, aunque sea con retraso.

Preguntas frecuentes

Twitch how Ban the use of streams to teaching Amazon AI