Big Tech in ‘underground’ race to license archives that will train Artificial Intelligence
Big Tech in ‘underground’ race to license archives that will train Artificial Intelligence
Photobucket está cambiando su estrategia para licenciar su vasto archivo de miles de millones de fotos y videos a desarrolladores de inteligencia artificial generativa, lo que marca un giro desde el raspado web gratuito hacia la adquisición de datos mediante pago. Este movimiento destaca la urgente demanda de conjuntos de datos de alta calidad y conformes con las leyes de derechos de autor, ya que las grandes empresas tecnológicas buscan entrenar modelos de IA sin enfrentar litigios. El artículo ilustra un mercado en crecimiento donde los titulares de datos privados pueden monetizar su contenido histórico. Al negociar tarifas significativas por el acceso a sus archivos, estas entidades están aprovechando la escasez de datos que no pueden ser raspados, demostrando cómo los activos digitales históricos están ganando valor en el panorama actual de la IA. Este caso es relevante para los datos abiertos porque subraya la tensión entre la información accesible y el control propietario. A medida que la industria de la IA depende cada vez más de conjuntos de datos cerrados y licenciados, se cuestionan los principios de apertura al priorizar el acceso exclusivo sobre el intercambio libre, lo que podría limitar la disponibilidad de datos de entrenamiento para iniciativas de IA de código abierto y impulsadas por la comunidad.
Fuente: thehindu.comPublicado el 2024-04-07