Google Now Allowing Website Owners to Opt Out of Google Bard
Google Now Allowing Website Owners to Opt Out of Google Bard
Google ha introducido un mecanismo que permite a los editores de sitios web optar por no participar de forma selectiva en su crawler de IA generativa, Google-Extended, que alimenta servicios como Bard. Esta actualización aborda preocupaciones sobre la privacidad de los datos y la propiedad intelectual, al permitir que los propietarios de sitios web impidan que su contenido se utilice para entrenar modelos de IA sin desactivar el crawler estándar de búsqueda. Esta distinción es crucial para mantener la visibilidad en los motores de búsqueda mientras se protege la información propietaria, lo que representa un cambio significativo respecto a las opciones anteriores, que obligaban a los editores a bloquear todo el acceso. La relevancia de esta medida para los datos abiertos radica en la tensión entre el entrenamiento de modelos de lenguaje grandes con información públicamente disponible y el derecho emergente a optar por no participar. A medida que las empresas de IA dependen cada vez más del raspado web (web scraping) para alimentar sus sistemas, este desarrollo destaca la creciente necesidad de un control granular sobre el uso de los datos. Esto obliga a reevaluar lo que se considera "datos públicos" cuando los propietarios de dichos datos desean explícitamente restringir su uso para el entrenamiento comercial de IA, desafiando la suposición predeterminada de accesibilidad abierta. Además, esta herramienta garantiza que los editores puedan detener no solo los productos actuales de IA, como Vertex AI, sino también las generaciones futuras, proporcionando salvaguardias a largo plazo. Esta evolución en los controles de los editores de sitios web refleja una tendencia más amplia en la industria, donde la facilidad de acceso a los datos se está equilibrando con las demandas éticas y legales de los creadores de contenido. Esto subraya que las prácticas de datos abiertos están evolucionando para incluir mecanismos de consentimiento explícito, alterando fundamentalmente la forma en que los desarrolladores de IA pueden interactuar con el contenido web público.
Fuente: techtimes.comPublicado el 2023-09-30
Noticias relacionadas
- Here's how web publishers can opt out of Google crawlers scraping website data to train AI models | MediaNama
- Google Will Enable Web Admins To Block Systems from Scraping Sites for AI Training
- Google Lets Publishers Opt Out of AI Training Data
- OpenAI offers a way for creators to opt out of AI training data. It's so onerous that one artist called it 'enraging.'