OpenAI Unlikely To Incorporate Its For-Profit Arm Within California After Gavin Newsom Signs Into Law A Bill That Mandates Training Data Disclosure For AI Models

La nueva legislación de California exige que los desarrolladores de inteligencia artificial divulguen resúmenes detallados de los conjuntos de datos utilizados para entrenar sus modelos, incluyendo las fuentes, el estado de los derechos de autor y el volumen de datos. Esta medida obliga a una mayor transparencia en relación con la información propietaria que alimenta a la IA generativa, impactando directamente en cómo las empresas manejan la propiedad intelectual y la obtención de datos en sus procesos de desarrollo. OpenAI, que actualmente está pasando de una estructura sin fines de lucro a una corporación comercial de beneficio público, enfrenta una fuerte resistencia a estas regulaciones. La empresa considera que los requisitos obligatorios de divulgación añaden costos innecesarios y exponen secretos competitivos, lo que hace poco probable que incorpore sus operaciones con fines de lucro dentro del estado. Esta tensión destaca la fricción entre los esfuerzos regulatorios para frenar las prácticas opacas de la IA y los intereses estratégicos de los principales actores tecnológicos que priorizan el dominio del mercado. Este desarrollo es crucial para el movimiento de datos abiertos, ya que establece un precedente legal para auditar los datos de entrenamiento de la IA. Al requerir resúmenes públicos de la composición de los conjuntos de datos, la ley desafía la naturaleza de "caja negra" de la IA comercial, promoviendo la responsabilidad en el uso de los datos. Esto sugiere un futuro en el que el origen y las licencias de los datos de entrenamiento ya no sean secretos comerciales, sino registros públicos, asegurando que los creadores de datos y el público tengan una visión más clara de cómo se está utilizando su información.

Source: wccftech.com
Published on 2024-09-30