AI and You: No to OpenAI Scraping, Don't Eat Those Mushrooms, Prompt Jobs
AI and You: No to OpenAI Scraping, Don't Eat Those Mushrooms, Prompt Jobs
Los principales editores y empresas tecnológicas están bloqueando activamente a los rastreadores web de inteligencia artificial (IA) para proteger su contenido protegido por derechos de autor, lo que marca un cambio significativo en el panorama legal relacionado con la IA. Esta acción colectiva subraya la creciente tensión entre los proveedores de datos y los desarrolladores de IA, que dependen de grandes volúmenes de texto en línea para entrenar sus modelos. Al optar por excluirse, estas entidades están afirmando su propiedad sobre su propiedad intelectual y exigiendo que las futuras prácticas de entrenamiento de IA respeten los límites legales en lugar de asumir un permiso implícito. Para la comunidad de datos abiertos, esta tendencia destaca un desafío crítico: la viabilidad futura de la recopilación de datos a gran escala para la investigación en IA depende de establecer marcos legales sostenibles para el acceso a los datos. Si las fuentes de datos se retiran cada vez más de la disponibilidad pública o imponen restricciones estrictas de licenciamiento, la suposición de acceso gratuito y abierto a datos a escala de internet se vuelve precaria. Este movimiento sugiere que los desarrolladores deben cambiar hacia asociaciones con datos licenciados o la generación de datos sintéticos, alterando fundamentalmente cómo se obtienen y utilizan los conjuntos de datos abiertos. En última instancia, la resistencia al raspado sin restricciones implica que la era de tratar todo el contenido web como material de entrenamiento gratuito está llegando a su fin. Las iniciativas de datos abiertos deben adaptarse abogando por estándares claros de licenciamiento que equilibren la innovación con los derechos de los creadores. Sin protocolos definidos, la industria corre el riesgo de fragmentarse, donde los datos valiosos quedan bloqueados detrás de muros de pago o barreras legales, complicando los esfuerzos para mantener conjuntos de datos abiertos, transparentes y diversos para el desarrollo de IA.
Fuente: cnet.comPublicado el 2023-09-03