Amazon is reviewing whether Perplexity AI improperly scraped online content

Perplexity AI enfrenta escrutinio por supuestamente extraer contenido protegido por derechos de autor sin autorización, lo que ha llevado a Amazon a revisar la situación. Dado que Perplexity depende de Amazon Web Services, este incidente destaca la responsabilidad crítica que tienen los proveedores de servicios en la nube al hacer cumplir los términos de servicio frente a prácticas abusivas de recopilación de datos. La revisión subraya la necesidad de transparencia en cuanto a cómo las empresas de inteligencia artificial utilizan fuentes de datos externas. La controversia surge de acusaciones de plagio y citas fabricadas, lo que genera preocupaciones sobre la integridad de los resúmenes generados por IA. Perplexity defiende sus métodos, afirmando que agrega resultados de otros sistemas en lugar de entrenarse directamente con contenido protegido. Sin embargo, esta defensa no ha logrado calmar del todo las preocupaciones respecto al uso no autorizado de material periodístico, un tema central en la gobernanza de datos abiertos. Esta situación es altamente relevante para los datos abiertos, ya que ilustra la tensión entre la información accesible y los derechos de propiedad intelectual. Demuestra cómo los intermediarios de IA pueden oscurecer las fuentes originales, complicando los esfuerzos por mantener estándares éticos en el manejo de datos. El resultado podría influir en futuras regulaciones sobre la extracción de datos web (web scraping), enfatizando la necesidad de una atribución clara y el consentimiento del usuario en los ecosistemas de agregación de datos.

Source: economictimes.indiatimes.com
Published on 2024-06-30