Mira, según un reciente informe de 404 Media, ha surgido un buen lío con la startup de inteligencia artificial Runway. Resulta que estos tíos han estado usando videos de YouTube y hasta películas pirateadas para entrenar su generador de video de texto a video. Este chisme ha encendido un debate bastante serio sobre los límites éticos y legales en el uso de contenido con derechos de autor para desarrollar modelos de IA.
¿De dónde viene el contenido?
El informe nos cuenta que Runway ha metido en su saco una cantidad enorme de datos. Han usado videos de canales de grandes peces como Netflix, Disney, Nintendo y Rockstar Games. También han agarrado contenido de populares creadores de YouTube como MKBHD, Linus Tech Tips y Sam Kolder, además de medios como The Verge, The New Yorker, Reuters y Wired.
Un ex empleado de Runway soltó que la elección de estos canales fue un esfuerzo en grupo para seleccionar videos de alta calidad para construir su modelo. Usaron un rastreador web que empleaba proxies para descargar masivamente y evitar que Google los bloqueara. ¡Vaya movida!
Financiamiento y herramientas de Runway
Runway, que está respaldada por millones de dólares de Alphabet (la casa matriz de Google) y Nvidia, ofrece herramientas que permiten a los usuarios crear videos realistas con IA. Su última joya, Gen-3 Alpha, lanzada en junio, promete crear videos en cualquier estilo que te puedas imaginar. Como otros modelos de IA, Gen-3 Alpha necesita una variedad tremenda de contenido para su entrenamiento.
Uso de sitios de piratería
Pero eso no es todo. El informe de 404 Media también señala que Runway se ha surtido en sitios de piratería como KissCartoon, que ofrece anime y otras animaciones gratis. No está muy claro si todos estos videos fueron usados para entrenar el modelo Gen-3 Alpha. En una entrevista con TechCrunch, Anastasis Germanidis, cofundador de Runway, dijo que usan «conjuntos de datos internos y curados», sin soltar más prenda.
Repercusiones y respuestas
Al ser consultado, Google se lavó las manos con una declaración del CEO de YouTube, Neal Mohan, quien dijo que entrenar IA con videos de YouTube es una “clara violación” de sus políticas. The Verge contactó a Runway para obtener comentarios, pero hasta ahora no hay respuesta.
Y ojo, Runway no es la única en el ajo. A principios de este año, la CTO de OpenAI, Mira Murati, comentó que no estaba segura de si su generador de video de texto a video, Sora, había sido entrenado con videos de YouTube. Un informe de Proof News y Wired también destapó que empresas como Anthropic, Apple, Nvidia y Salesforce entrenaron sus modelos de IA con más de 170,000 videos de YouTube.
Reflexión y futuro
Entonces, la pregunta del millón: ¿Dónde trazamos la línea entre el uso justo y la violación de derechos? ¿Cómo deben las empresas de tecnología equilibrar la necesidad de datos extensos y diversos con el respeto a los derechos de los creadores de contenido?
Nuestra opinión al respecto
En nuestra opinión, el avance en inteligencia artificial debe ir de la mano con un marco ético y legal que proteja los derechos de los creadores de contenido. La innovación tecnológica no debe ser excusa para la explotación indiscriminada de recursos ajenos. Es fundamental que las empresas sean transparentes sobre sus prácticas de entrenamiento de modelos y trabajen en conjunto con los creadores de contenido para encontrar soluciones que beneficien a ambas partes.
Este escenario también resalta la necesidad de una mayor regulación en el campo de la inteligencia artificial, garantizando que el progreso tecnológico no se realice a expensas de los derechos de individuos y empresas que generan el contenido utilizado. En un mundo donde la IA juega un papel cada vez más relevante, la responsabilidad y la ética deben ser los pilares fundamentales del desarrollo tecnológico.
¿Qué piensas tú sobre el uso de contenido protegido para entrenar modelos de IA?


