Investigation finds companies are training AI models with YouTube content without permission
Los principales desarrolladores de inteligencia artificial están enfrentando un intenso escrutinio por utilizar transcripciones no autorizadas de videos de YouTube para entrenar sus modelos. Una investigación reveló que empresas como Apple y Nvidia utilizaron un conjunto de datos que contenía casi 175.000 subtítulos de videos, recopilados sin el permiso de los creadores. Esta práctica viola los términos de servicio de YouTube, que prohíben el raspado automatizado (scraping), sin embargo, estas firmas continuaron integrando el contenido en sus procesos de entrenamiento. El descubrimiento ha provocado una gran indignación entre los creadores de contenido, quienes sienten que su propiedad intelectual está siendo explotada sin compensación ni consentimiento. Este caso destaca un dilema ético crítico dentro de la comunidad de datos abiertos en relación con el consentimiento y los derechos de propiedad intelectual. Si bien organizaciones como EleutherAI buscan democratizar el desarrollo de la inteligencia artificial al reducir las barreras de entrada, sus métodos a menudo entran en conflicto con los estándares legales y éticos esperados de las plataformas de contenido. El uso de datos de canales eliminados o contenido retirado subraya aún más la falta de transparencia y el desprecio por los derechos de los creadores. Estas acciones cuestionan la noción de que el acceso abierto se alinea inherentemente con la innovación ética, planteando serias dudas sobre la legitimidad de dichos conjuntos de datos. Las implicaciones para los datos abiertos son profundas, ya que este incidente sugiere que la accesibilidad no debe lograrse a costa del cumplimiento legal o de los derechos de los creadores. Advierte que las fuentes de datos no verificadas pueden exponer a las organizaciones a importantes riesgos legales y reputacionales, complicando el panorama regulatorio para el desarrollo de la inteligencia artificial. En última instancia, este artículo sirve como un relato de advertencia, enfatizando que las iniciativas sostenibles de datos abiertos requieren mecanismos robustos para el consentimiento y la atribución adecuada. Sin abordar estos fundamentos éticos, la búsqueda de datos abiertos podría obstaculizar, en lugar de ayudar, al avance responsable de las tecnologías de inteligencia artificial.
Source: techradar.comPublished on 2024-07-17
Related news
- AI companies are finally being forced to cough up for training data
- Protección de datos personales: desafíos en un mundo digitalizado
- Disappearance of victim in Gambia: ECOWAS Court orders Ghana to release documents to applicant - Ghanaian Times
- FTC seeking details on Amazon deal with AI startup Adept - ET Telecom