ia
Privacidad en la era de la IA

Amazon ha utilizado contenido de Twitch para entrenar su IA y ahora permite a los usuarios excluirse

La plataforma de streaming ha empleado durante años el material generado por los usuarios para mejoras en sus modelos de inteligencia artificial generativa.

Durante años, el vasto archivo de contenido generado en Twitch —una de las plataformas de streaming más grandes del mundo y propiedad de Amazon— ha servido como fuente de datos para el entrenamiento de los sistemas de inteligencia artificial de la compañía. Esta práctica, que se extendía de forma tácita, ha sido ahora explicitada con la introducción de una nueva política que concede a los usuarios la capacidad de decidir si su contenido contribuye o no a este fin.

La decisión de Amazon de permitir la exclusión (opt-out) del uso de contenido de Twitch para el desarrollo de IA generativa marca un punto de inflexión en la gestión de datos de usuario por parte de las grandes tecnológicas. Hasta la fecha, el empleo de este material para "mejoras futuras en modelos de IA generativa" se realizaba sin una opción directa de veto por parte de los creadores. Este cambio sugiere una respuesta a la creciente preocupación pública y regulatoria sobre la privacidad de los datos y la ética en el entrenamiento de IA.

El contenido generado por usuarios (UGC, por sus siglas en inglés) en plataformas como Twitch es de inmenso valor para los desarrolladores de inteligencia artificial. Incluye interacciones en tiempo real, lenguaje natural en contextos diversos y una amplia gama de comportamientos y reacciones humanas, elementos cruciales para refinar la comprensión del lenguaje, la generación de voz o la simulación de interacciones en modelos de IA avanzados. La disponibilidad de un volumen masivo y diverso de UGC permite a los algoritmos aprender de escenarios complejos y matices que son difíciles de replicar con datos sintéticos.

La introducción de la opción de exclusión no solo ofrece a los usuarios un mayor control sobre su huella digital, sino que también establece un precedente sobre cómo las empresas tecnológicas abordarán el suministro de datos para la IA en el futuro. Este movimiento se enmarca en un debate más amplio sobre quién es el propietario de los datos que alimentan los sistemas de IA y cómo se deben compensar o reconocer a los creadores de ese contenido.

Por qué importa

El entrenamiento de modelos de inteligencia artificial, especialmente los generativos, exige cantidades ingentes de datos. El contenido generado por usuarios de plataformas como Twitch es particularmente valioso por su diversidad y su reflejo del lenguaje y comportamiento humanos reales. La reciente política de exclusión de Amazon responde a la creciente demanda de transparencia y control por parte de los usuarios sobre cómo sus datos son utilizados para el desarrollo de tecnologías emergentes, redefiniendo las prácticas de consentimiento en la era de la IA.

Antecedentes

Twitch, adquirida por Amazon en 2014, ha sido durante años una fuente rica de contenido audiovisual y de interacción social. La utilización de este material para el entrenamiento de la IA de Amazon ha sido una práctica continua. La novedad reside en la explicitación de este uso y en la implementación de una herramienta que permite a los usuarios optar por no participar en futuros procesos de mejora de modelos de IA generativa, marcando un ajuste en las políticas de datos de la compañía.

Datos clave

Plataforma afectadaTwitch
PropietarioAmazon
Tiempo de uso de datosDurante años
Cambio recienteIntroducción de opción de exclusión (opt-out)
Propósito declaradoMejora de modelos de IA generativa

Fuente original: Ars Technica

Publicaciones Similares

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *