Here's how web publishers can opt out of Google crawlers scraping website data to train AI models | MediaNama

Here's how web publishers can opt out of Google crawlers scraping website data to train AI models | MediaNama

Google ha presentado Google-Extended, un nuevo mecanismo de exclusión voluntaria que permite a los editores web impedir que su contenido sea utilizado para entrenar modelos de inteligencia artificial generativa, como Bard y Vertex AI. Este token independiente permite a los administradores de sitios gestionar el uso de datos específicamente para el entrenamiento de IA, mientras sigue permitiendo la indexación estándar en los motores de búsqueda. Al ofrecer este control, Google reconoce la creciente necesidad de transparencia y elección en la forma en que los activos digitales se recopilan con fines de aprendizaje automático. Este avance es significativo porque aborda las preocupaciones críticas sobre derechos de autor y atribución que tienen los editores respecto al raspado no autorizado de datos. A medida que los conflictos se intensifican entre desarrolladores de IA y creadores de contenido, ofrecer herramientas de exclusión voluntaria representa un paso constructivo hacia la resolución de estas tensiones. Se alinea con las tendencias del sector, donde las principales plataformas están proporcionando cada vez más mecanismos para restringir el acceso a los datos, equilibrando así la innovación con los derechos de los editores y la retención de audiencia. La relevancia para los datos abiertos radica en el impulso hacia controles estandarizados y legibles por máquina sobre la accesibilidad de los datos. Si bien los principios de datos abiertos abogan por un acceso sin restricciones, esta actualización destaca la necesidad de respetar los derechos de propiedad intelectual mediante protocolos técnicos claros, como robots.txt. Subraya el panorama en evolución donde la gobernanza de datos debe conciliar la apertura con la gestión basada en el consentimiento del contenido propietario, estableciendo un precedente para futuras políticas de ética en IA y uso de datos.

Fuente: medianama.com
Publicado el 2023-09-30