Amazon Web Services Investigates Perplexity AI Over Web Scraping Allegations

Amazon Web Services (AWS) ha iniciado una investigación contra Perplexity AI por posibles violaciones de sus términos de servicio como proveedor de servicios en la nube. La investigación se centra en las acusaciones de que Perplexity utiliza bots automatizados para extraer contenido de sitios web que han restringido explícitamente dicho acceso mediante el Protocolo de Exclusión de Robots (Robots Exclusion Protocol). Aunque esta norma técnica no es jurídicamente vinculante por sí sola, su cumplimiento suele hacerse efectivo a través de obligaciones contractuales y normas específicas de cada plataforma. AWS enfatiza que sus clientes deben respetar estas directrices, destacando la tensión entre el cumplimiento de las políticas corporativas y las realidades técnicas de la extracción de datos en la era de la inteligencia artificial. La presión aumenta a medida que las pruebas sugieren que Perplexity ignoró bloqueos específicos implementados por importantes editoriales como Condé Nast, The Guardian y Forbes. Las investigaciones rastrearon la actividad de extracción de datos a direcciones IP vinculadas a la infraestructura de AWS, lo que ha generado preguntas sobre si el uso de servicios en la nube conformes para llevar a cabo una recolección de datos no conforme constituye una violación del contrato. El liderazgo de Perplexity ha desestimado estas preocupaciones como malentendidos sobre el funcionamiento de Internet, atribuyendo la recopilación de datos a rastreadores de terceros. Sin embargo, la negativa a detener inmediatamente estas actividades a pesar de las prohibiciones explícitas plantea importantes interrogantes sobre la responsabilidad y los límites éticos de la formación de modelos de IA con contenido protegido. Este caso es altamente relevante para el movimiento de datos abiertos, ya que ilustra el delicado equilibrio entre el libre flujo de información y los derechos de los creadores de contenido. A medida que los defensores de los datos abiertos abogan por la transparencia y la accesibilidad, este conflicto subraya la necesidad de establecer normas claras y aplicables sobre cómo se recopilan, almacenan y utilizan los datos. Demuestra que los protocolos técnicos por sí solos son insuficientes sin respaldo legal y contractual, instando a la comunidad a desarrollar marcos robustos que protejan tanto la apertura de los datos como la propiedad intelectual de sus fuentes.

Source: techtimes.com
Published on 2024-06-29