Column: It's not just Zoom: How websites and apps harvest your data to build AI

Column: It's not just Zoom: How websites and apps harvest your data to build AI

La reciente controversia en torno a los términos de servicio de Zoom destaca un cambio crítico en la forma en que las plataformas digitales manejan los datos de los usuarios, revelando que la información personal procedente de comunicaciones íntimas se está considerando cada vez más para el entrenamiento de inteligencia artificial. Este incidente subraya una realidad más amplia, a menudo invisible: casi todo el contenido público en línea, desde publicaciones en redes sociales hasta blogs profesionales, se está extrayendo y utilizando para entrenar modelos de lenguaje grandes. La reacción negativa demuestra que los usuarios ya no son receptores pasivos de la extracción de datos, sino que exigen activamente transparencia sobre cómo sus huellas digitales son comercializadas y reutilizadas por las grandes empresas tecnológicas. Este panorama presenta un momento crucial para la comunidad de datos abiertos, que debe renegociar los contratos sociales y económicos que rigen el uso de los datos. A medida que las empresas de IA ingieren agresivamente vastas cantidades de material en línea existente, se está cuestionando la suposición por defecto de que la visibilidad pública implica consentimiento para la explotación comercial. El artículo sostiene que esta disrupción ofrece una oportunidad única para establecer nuevos estándares de consentimiento, forzando una reevaluación de lo que es social y éticamente aceptable en la recolección de datos. Sugiere que, sin una resistencia proactiva y regulaciones claras, la autonomía individual continuará erosionándose bajo el peso del procesamiento automatizado de datos. Para salvaguardar la privacidad, el artículo recomienda alejarse de las plataformas con políticas de datos opacas hacia servicios construidos con cifrado y consentimiento explícito del usuario, como Signal o Proton Mail. Para aquellos que mantienen sitios web públicos, las salvaguardias técnicas como robots.txt pueden ayudar a restringir la extracción no autorizada. En última instancia, esta narrativa es vital para los datos abiertos porque enmarca el actual auge de la IA no solo como un avance tecnológico, sino como una cuestión de libertades civiles. Llama a un cambio fundamental hacia una "doctrina del consentimiento", instando a desarrolladores y usuarios por igual a priorizar la privacidad desde el diseño y resistirse activamente a la acumulación descontrolada de datos personales para el desarrollo de IA.

Fuente: latimes.com
Publicado el 2023-08-17