Open-source AI definition finally gets its first release candidate - and a compromise

La Iniciativa de Código Abierto (Open Source Initiative, OSI) ha publicado la primera versión candidata de una Definición de Inteligencia Artificial de Código Abierto, estableciendo un marco estandarizado para distinguir la IA genuinamente de código abierto del llamado "lavado de imagen de código abierto" (open washing). La propuesta define la IA de código abierto mediante cuatro libertades fundamentales: el derecho a usar, estudiar, modificar y compartir el sistema. Es crucial que el código fuente completo, los parámetros del modelo y los pesos estén disponibles bajo licencias aprobadas por la OSI, garantizando que los usuarios posteriores dispongan de las herramientas necesarias para comprender y bifurcar (fork) la tecnología. Esta estandarización es vital para mantener la integridad en el ecosistema de la IA, evitando que las empresas afirmen falsamente su carácter abierto mientras retienen el control propietario. Un punto significativo de controversia y compromiso involucra a los datos de entrenamiento. Reconociendo las restricciones legales y de privacidad, la definición exige información suficientemente detallada sobre los datos de entrenamiento, en lugar de acceso completo a los conjuntos de datos en bruto. Este enfoque equilibra la transparencia con las realidades prácticas, reconociendo que ciertos datos no pueden compartirse libremente debido a leyes de derechos de autor o privacidad. Aunque algunos puristas argumentan que esto compromete la reproducibilidad, la OSI sostiene que exigir acceso completo a los datos limitaría la IA de código abierto únicamente a aquellos sistemas entrenados con datos públicamente disponibles, marginando efectivamente el campo. Este desarrollo es altamente relevante para open_data, ya que establece un precedente sobre cómo se manejan activos no tradicionales, como los pesos de los modelos y los metadatos de entrenamiento, dentro de la filosofía de código abierto. Desafía a la comunidad a redefinir la transparencia más allá del simple código, abordando las complejidades de las licencias de datos y la privacidad en la IA. Al forzar un diálogo sobre lo que constituye "abierto" en el contexto del aprendizaje automático, la OSI está creando un marco legal y técnico que influye en cómo las futuras iniciativas de datos abiertos deben navegar los derechos de propiedad intelectual y la privacidad de los usuarios.

Source: zdnet.com
Published on 2024-10-10