El New York Times ha iniciado un litigio histórico contra Microsoft y OpenAI, alegando que el uso no autorizado de su periodismo protegido por derechos de autor para entrenar modelos de inteligencia artificial generativa constituye una infracción masiva de derechos de autor. Esta demanda representa un momento crucial para la ética de los datos abiertos y la inteligencia artificial, ya que cuestiona la suposición fundamental de que la extracción de contenido web público para el aprendizaje automático es inherentemente permisible. Al reclamar daños y perjuicios y la destrucción de modelos que contienen sus obras, el Times destaca la urgente necesidad de marcos legales claros que regulen el uso de activos digitales en conjuntos de datos de entrenamiento, obligando a una reflexión sobre cómo la propiedad de los datos se entrelaza con la innovación tecnológica. El núcleo de la disputa radica en el argumento de que los sistemas de IA no solo ingieren este contenido, sino que también lo reproducen o sintetizan, eludiendo efectivamente los muros de pago y privando a los creadores de los ingresos por licencias. El Times sostiene que, mientras que los motores de búsqueda sirven para dirigir el tráfico hacia su plataforma, los desarrolladores de IA están aprovechando este acceso para retener a los usuarios dentro de sus propios ecosistemas sin compensación. Esta distinción es crucial para la comunidad de datos abiertos, ya que subraya la diferencia entre facilitar el descubrimiento de información y extraer valor mediante la reproducción automatizada, lo que sugiere que las prácticas actuales de datos pueden carecer de los mecanismos de consentimiento necesarios. En última instancia, este caso señala un cambio más amplio hacia la exigencia de acuerdos de licencia explícitos para el desarrollo comercial de IA, alejándose de las interpretaciones ambiguas del uso justo. El fracaso de las negociaciones amistosas con el Times, en contraste con los recientes acuerdos con otros editores, demuestra que los principales medios de comunicación están priorizando la monetización directa y el control sobre sus datos. Esta tendencia fomenta una economía de datos más estructurada y equitativa, donde las iniciativas de datos abiertos deben navegar por protecciones de derechos de autor cada vez más estrictas, asegurando que los creadores sean reconocidos y compensados por la contribución de su trabajo a los avances en IA.

Source:
Published on 2023-12-29