What does 'open source AI' mean, anyway? | TechCrunch
El artículo destaca una desconexión crítica en la industria de la inteligencia artificial (IA), donde el concepto tradicional de software de código abierto no resulta aplicable a la IA. A diferencia del código legible por humanos, los pesos de las redes neuronales son opacos y no reproducibles, lo que hace que términos como “IA de código abierto” sean técnicamente inexactos. Esta comprensión ha impulsado a la Open Source Initiative (OSI) a desarrollar un nuevo marco que distingue entre la verdadera apertura y la mera accesibilidad, abordando la confusión generada por los modelos publicados por las principales empresas tecnológicas, que imponen licencias de uso restrictivas. Para resolver esta ambigüedad, la OSI está estableciendo una definición formal de IA de código abierto que se centra en la transparencia y la reproducibilidad, en lugar de limitarse a la publicación de los pesos del modelo. El marco propuesto subraya la importancia de divulgar las metodologías de entrenamiento, el origen de los datos y los procesos de procesamiento, reconociendo que la disponibilidad completa de los conjuntos de datos suele ser poco práctica o legalmente imposible. Al cambiar el enfoque hacia procesos verificables e instrucciones claras, la definición pretende garantizar que los sistemas de IA puedan estudiarse y, potencialmente, replicarse, manteniendo el espíritu de apertura a pesar de la naturaleza estadística del entrenamiento de los modelos. Este esfuerzo es altamente relevante para el movimiento de datos abiertos, ya que busca establecer estándares claros de transparencia en las tecnologías basadas en datos. Dado que la IA depende en gran medida de fuentes de datos propietarias y, a menudo, opacas, definir lo que constituye la apertura requiere criterios rigurosos para la trazabilidad de los datos y la lógica de procesamiento. El trabajo de la OSI proporciona una plantilla crucial para distinguir entre prácticas genuinas de datos abiertos y afirmaciones de marketing, ayudando a la comunidad a navegar por el complejo panorama ético y técnico en el que los datos, el código y los resultados están inextricablemente vinculados.
Source: techcrunch.comPublished on 2024-06-23
Related news
- UMG tells Apple and Spotify to block AI scraping of lyrics and melodies
- Los números de la Eurocopa retratan a Tebas por su mal manejo de la Liga
- AI companies are reportedly still scraping websites despite protocols meant to block them
- Rentas Inmobiliarias se niega a entregar información vía Ley de Transparencia