Several AI companies said to be ignoring robots dot txt exclusion, scraping content without permission: report

Las empresas de inteligencia artificial están cada vez más eludiendo el Protocolo de exclusión de robots para extraer contenido web sin permiso, socavando los estándares tradicionales de control de los rastreadores. Esta falta de cumplimiento generalizada ha provocado intensos conflictos con los editores, quienes sienten que su propiedad intelectual está siendo explotada. Al ignorar estas barreras técnicas, los desarrolladores de IA priorizan el acceso a los datos sobre la etiqueta web establecida, lo que ha llevado a acusaciones de plagio y uso no autorizado. El conflicto pone de manifiesto una tensión crítica en la publicación digital, donde bloquear el acceso de la IA mediante protocolos estándar resulta en una menor visibilidad sin ofrecer una protección efectiva. Los editores se ven obligados a tomar decisiones difíciles, optando entre emprender acciones legales, negociar licencias o perder tráfico. Esta dinámica revela la insuficiencia de las salvaguardas técnicas existentes en una era en la que la IA generativa requiere conjuntos masivos de datos, creando un desequilibrio de poder entre los creadores de contenido y las empresas tecnológicas. Esta situación es crucial para el concepto de datos abiertos, ya que desafía la suposición de que la información públicamente disponible es libre para todo tipo de usos. Subraya la urgente necesidad de marcos de gobernanza claros que equilibren la innovación con el respeto a los derechos de autor. El fracaso de los protocolos voluntarios sugiere que las futuras iniciativas de datos abiertos deben incorporar mecanismos robustos y aplicables para garantizar una obtención ética de los datos y una compensación justa para los creadores.

Source: tomshardware.com
Published on 2024-06-22