Perplexity AI Scrutinized for Unauthorized Web Crawling

Investigaciones recientes revelan que los principales agregadores de inteligencia artificial, como Perplexity AI, suelen alucinar información falsa y eludir las restricciones estándar de acceso a sitios web. Estos sistemas frecuentemente ignoran los protocolos diseñados para limitar el acceso de los rastreadores (crawlers), lo que genera preocupaciones significativas sobre cómo las herramientas de IA obtienen y respetan la propiedad digital. Este comportamiento no solo socava la confianza en los resúmenes generados por IA, sino que también desafía los marcos éticos que regulan el uso de datos en la web. El problema central radica en la falta de verificación humana y en la ausencia de valor original añadido por estas plataformas. Al reproducir contenido factual sin la atribución adecuada ni un contexto transformador, los modelos de IA adoptan prácticas similares al plagio en lugar de ampararse en el uso justo (fair use). Este modelo extractivo devora a los editores de noticias al reducir la necesidad de que los usuarios visiten los sitios de origen, amenazando así sus fuentes de ingresos y su sostenibilidad a largo plazo. Este artículo es altamente relevante para el ámbito de los datos abiertos, ya que destaca la tensión entre el acceso abierto a la información y los derechos de los creadores de contenido. Subraya la urgente necesidad de contar con marcos legales y técnicos sólidos que equilibren la innovación en IA con la protección de los derechos de autor. A medida que los ecosistemas de datos abiertos evolucionan, es esencial garantizar que las herramientas de IA respeten las políticas de uso y proporcionen una compensación justa para mantener un entorno de información saludable y sostenible.

Source: medianama.com
Published on 2024-06-22