Ir al contenido principal

Nos Dicen Gamers

Acusan a NVIDIA de usar videos de YouTube y Netflix sin permiso para entrenar su IA

Correos electrónicos internos, conversaciones de Slack y documentos obtenidos por 404 Media muestran cómo Nvidia creó un modelo de video base que aún no se ha publicado.
Documentos filtrados revelan que NVIDIA ha estado recolectando de manera encubierta enormes cantidades de datos de videos de YouTube para entrenar sus modelos de IA sin el consentimiento de los creadores ni de Google.

Documentos filtrados por 404 Media han revelado que NVIDIA ha estado recolectando masivamente datos de videos de YouTube para entrenar sus modelos de inteligencia artificial (IA).

Esta práctica plantea serias dudas legales y éticas y se añade a una creciente lista de prácticas cuestionables en el entrenamiento de IA llevadas a cabo por corporaciones y startups.

¿Para qué lo hace NVIDIA?

NVIDIA ha utilizado estos datos para mejorar diversos productos, incluyendo su modelo de aprendizaje profundo Cosmos, algoritmos para vehículos autónomos, un avatar digital y su herramienta de creación de mundos 3D, Omniverse. Además, la empresa empleó sofisticadas técnicas para ocultar sus actividades, como el uso de máquinas virtuales que cambiaban automáticamente las direcciones IP para evitar ser detectada.

Tanto los creadores de los videos como Google, el propietario de YouTube y cliente de NVIDIA, no dieron su consentimiento para la extracción de estos datos.

Los documentos internos de la empresa muestran una estrategia audaz y cuestionable, en la que se optó por realizar la extracción sin el consentimiento de las partes involucradas, con la esperanza de no enfrentar cuestionamientos futuros.

El vicepresidente de investigación de NVIDIA, Ming-Yu Liu, en un correo electrónico, describió su ambición de crear una «fábrica de datos de video» capaz de producir una experiencia visual equivalente a toda una vida humana por día. Esto refleja la magnitud y la intensidad del esfuerzo para acumular datos masivos sin considerar las implicaciones éticas.

En un caso particularmente alarmante, NVIDIA utilizó un conjunto de datos específico, HD-VG-130M, que se había creado para la investigación académica, para entrenar sus modelos comerciales. Este uso inapropiado de datos diseñados para fines académicos subraya el problema de comercializar información sin consentimiento, un asunto que ha generado críticas entre expertos en el campo.

NVIDIA, al ser un actor clave en la industria de IA por su dominio en el mercado de unidades de procesamiento gráfico, ha suscitado preocupación debido a su uso de datos propiedad de Google. Aunque NVIDIA defiende que sus prácticas cumplen con la ley de derechos de autor, la controversia continúa en torno a la legalidad y la ética de su enfoque de entrenamiento de IA.

Compartir
Compartir
Compartir
Compartir
Picture of Leonardo Ancajima

Leonardo Ancajima

Periodista de videojuegos y tecnología. Bachiller de la UNMSM. Apasionado de los esports y lucha libre.