AI Chatbots are scraping news reporting and copyrighted content, News Media Alliance says - KTVZ
Un importante grupo comercial de medios de comunicación ha emitido una advertencia contundente a los desarrolladores de inteligencia artificial, afirmando que han extraído extensamente contenido periodístico protegido por derechos de autor para entrenar sus chatbots generativos sin autorización ni compensación. La investigación destaca que estos sistemas de IA dependen desproporcionadamente de material periodístico de alta calidad, lo que demuestra un reconocimiento implícito de su valor único, mientras que al mismo tiempo socavan la sostenibilidad económica de las editoriales que lo producen. Esta dinámica amenaza no solo la supervivencia de la industria periodística, sino también la fiabilidad a largo plazo de los modelos de IA que dependen de fuentes de datos confiables. La industria argumenta que la defensa habitual de que la IA “aprende” hechos como los humanos es defectuosa, ya que los modelos retienen expresiones protegidas en lugar de únicamente conceptos subyacentes. En respuesta, muchas editoriales han implementado barreras técnicas para evitar futuras extracciones de datos, pero estas medidas no abordan las enormes cantidades de contenido ya utilizadas para el entrenamiento. En consecuencia, el grupo comercial insta a los responsables políticos a clasificar legalmente este uso no autorizado como infracción, enfatizando que las normas voluntarias actuales son insuficientes para proteger la propiedad intelectual en la era del aprendizaje automático. Este tema es crucial para el movimiento de datos abiertos, ya que cuestiona la suposición de que la información de acceso público es de libre uso para el desarrollo comercial de la IA. Destaca la urgente necesidad de marcos éticos y legales claros que equilibren la accesibilidad de los datos con los derechos de los creadores. Para los defensores de los datos abiertos, este caso subraya la necesidad de garantizar que los conjuntos de datos utilizados para entrenar la IA se obtengan mediante licencias adecuadas, preservando tanto la integridad del conocimiento generado por seres humanos como la sostenibilidad del ecosistema mediático que lo produce.
Source: ktvz.comPublished on 2023-11-02