News outlets are accusing Perplexity of plagiarism and unethical web scraping | TechCrunch
El artículo destaca las crecientes tensiones éticas y legales entre las empresas de inteligencia artificial generativa, como Perplexity AI, y los editores tradicionales. Perplexity enfrenta acusaciones de ignorar las restricciones de los sitios web para extraer contenido y de producir resúmenes que rozan la plagia. Aunque la compañía argumenta que sus acciones constituyen un uso legítimo y son distintas del rastreo tradicional, los editores sostienen que la automatización de resúmenes equivale a un robo de su periodismo sin la debida compensación o reconocimiento, desafiando los límites de la propiedad intelectual en la era digital. Para la comunidad de datos abiertos, este caso subraya la importancia crítica de la transparencia en el origen de los datos y la fragilidad de los protocolos actuales de acceso a la web. La disputa revela cómo los sistemas automatizados pueden eludir fácilmente barreras técnicas como los archivos robots.txt, planteando preguntas urgentes sobre la integridad de los datos y los derechos de los proveedores de datos. A medida que los modelos de IA dependen cada vez más de grandes volúmenes de datos de internet, la falta de estándares claros y aplicables para el uso de datos amenaza con erosionar la confianza y generar incertidumbre legal tanto para los agregadores de datos como para los creadores originales de contenido. Las implicaciones a largo plazo sugieren una posible crisis para la creación de contenido si los editores no pueden sostener sus ingresos frente a la automatización de resúmenes impulsada por IA. Si el periodismo original se vuelve económicamente inviable debido al rastreo sin control, la calidad y cantidad de datos disponibles para el consumo público y el entrenamiento de IA podrían disminuir drásticamente. Este escenario advierte que, sin marcos equitativos para el intercambio y atribución de datos, el ecosistema podría volver a depender de datos sintéticos, comprometiendo la precisión y diversidad de la información disponible para el acceso abierto y la investigación.
Source: techcrunch.comPublished on 2024-07-03
Related news
- The Download: mind-controlled prosthetics, and the price of AI training data
- Siete de cada diez latinoamericanos desconfían de su seguridad digital
- Sentient closes $85M seed round for open-source AI
- Política de privacidad
- 23 Public Institutions Fined GH¢1m for Violating RTI Law - The Ghanaian Chronicle