Major sites opt out of Apple’s AI scraping
Los principales editores están excluyendo sus datos del entrenamiento de la inteligencia artificial de Apple, lo que señala un cambio crítico en la forma en que se recopila el contenido web. Al actualizar sus archivos robots.txt, las organizaciones afirman el control sobre su propiedad intelectual frente a los rastreadores automatizados. Esta acción destaca el creciente conflicto entre las grandes empresas tecnológicas y los creadores de contenido en relación con los derechos de entrenamiento de la IA. El protocolo de exclusión de robots, una norma web de larga data, se ha convertido ahora en el campo de batalla para definir los límites en el uso de datos digitales. Esta situación tiene relevancia para los datos abiertos debido al desafío de mantener fuentes de información transparentes y accesibles. A medida que más entidades restringen el acceso de los bots, la exhaustividad de los conjuntos de datos públicamente disponibles puede disminuir, afectando la investigación y la innovación que dependen de los datos abiertos de la web.
Source: macdailynews.comPublished on 2024-08-31
Related news
- Facebook, Instagram opt out of allowing Apple AI to scrape their data for training
- Bolivia supera los 11 millones de habitantes y Santa Cruz es el departamento más poblado
- Study: Transparency is often lacking in datasets used to train large language models
- Child abuse images removed from AI image-generator training source, researchers say