Google Will Enable Web Admins To Block Systems from Scraping Sites for AI Training
Google Will Enable Web Admins To Block Systems from Scraping Sites for AI Training
Principales proveedores de tecnología, como Google y OpenAI, están ofreciendo ahora a los administradores de sitios web la capacidad de controlar explícitamente si su contenido se utiliza para entrenar modelos de inteligencia artificial generativa. Al actualizar los protocolos técnicos estándar, los propietarios de sitios pueden optar por no permitir que sus datos sean ingeridos por sistemas de IA, reflejando movimientos similares realizados previamente por competidores. Este cambio refleja un creciente reconocimiento de la necesidad de consentimiento del usuario y soberanía de datos en el rápido entorno de desarrollo de la inteligencia artificial. La relevancia para los datos abiertos es profunda, ya que cuestiona la suposición de que el contenido web es inherentemente libre para la recolección sin restricciones por parte de la IA. Históricamente, gran parte de la web abierta ha servido como un recurso pasivo para el entrenamiento de modelos de lenguaje grandes, pero este nuevo paradigma empodera a los creadores para reclamar la propiedad y protección de su propiedad intelectual. Esto obliga a la industria de la IA a enfrentar preocupaciones sobre derechos de autor y presiones regulatorias, lo que podría llevar a prácticas más transparentes y legalmente conformes en la obtención de datos, respetando los derechos individuales y corporativos. Mirando hacia el futuro, esta dinámica podría crear una estructura de incentivos paradójica donde los editores eventualmente permitirán el acceso para permanecer visibles en los resultados de búsqueda impulsados por IA. A medida que las herramientas generativas se vuelvan integrales en las consultas de los usuarios, estar incluidos en los conjuntos de datos de entrenamiento podría convertirse en una ventaja estratégica para la visibilidad en línea. En consecuencia, el ecosistema de datos abiertos podría evolucionar de un entorno de libre acceso a un espacio negociado, donde el acceso esté condicionado a términos específicos, equilibrando las necesidades de la innovación en IA con la preservación de los derechos digitales y la integridad del contenido para los creadores.
Fuente: socialmediatoday.comPublicado el 2023-09-30
Noticias relacionadas
- Google Now Allowing Website Owners to Opt Out of Google Bard
- Here's how web publishers can opt out of Google crawlers scraping website data to train AI models | MediaNama
- OpenAI offers a way for creators to opt out of AI training data. It's so onerous that one artist called it 'enraging.'
- Books 3 has revealed thousands of pirated Australian books. In the age of AI, is copyright law still fit for purpose?