What does 'open source AI' mean, anyway? | TechCrunch

El artículo destaca una desconexión crítica en la industria de la inteligencia artificial (IA), donde el concepto tradicional de software de código abierto no resulta aplicable a la IA. A diferencia del código legible por humanos, los pesos de las redes neuronales son opacos y no reproducibles, lo que hace que términos como “IA de código abierto” sean técnicamente inexactos. Esta comprensión ha impulsado a la Open Source Initiative (OSI) a desarrollar un nuevo marco que distingue entre la verdadera apertura y la mera accesibilidad, abordando la confusión generada por los modelos publicados por las principales empresas tecnológicas, que imponen licencias de uso restrictivas. Para resolver esta ambigüedad, la OSI está estableciendo una definición formal de IA de código abierto que se centra en la transparencia y la reproducibilidad, en lugar de limitarse a la publicación de los pesos del modelo. El marco propuesto subraya la importancia de divulgar las metodologías de entrenamiento, el origen de los datos y los procesos de procesamiento, reconociendo que la disponibilidad completa de los conjuntos de datos suele ser poco práctica o legalmente imposible. Al cambiar el enfoque hacia procesos verificables e instrucciones claras, la definición pretende garantizar que los sistemas de IA puedan estudiarse y, potencialmente, replicarse, manteniendo el espíritu de apertura a pesar de la naturaleza estadística del entrenamiento de los modelos. Este esfuerzo es altamente relevante para el movimiento de datos abiertos, ya que busca establecer estándares claros de transparencia en las tecnologías basadas en datos. Dado que la IA depende en gran medida de fuentes de datos propietarias y, a menudo, opacas, definir lo que constituye la apertura requiere criterios rigurosos para la trazabilidad de los datos y la lógica de procesamiento. El trabajo de la OSI proporciona una plantilla crucial para distinguir entre prácticas genuinas de datos abiertos y afirmaciones de marketing, ayudando a la comunidad a navegar por el complejo panorama ético y técnico en el que los datos, el código y los resultados están inextricablemente vinculados.

Source: techcrunch.com
Published on 2024-06-23