The open-source AI boom is built on Big Tech’s handouts. How long will it last?
El desarrollo de inteligencia artificial de código abierto surgió como una respuesta necesaria a los costos prohibitivos del entrenamiento de modelos de lenguaje grandes. Al agrupar recursos y crear conjuntos de datos compartidos, los investigadores pudieron replicar sistemas avanzados sin asumir cargas financieras individuales, estableciendo un ecosistema colaborativo. Este enfoque democratiza el acceso, permitiendo que gobiernos, grupos civiles y no emprendedores participen en y examinen los avances tecnológicos, diversificando así a los contribuyentes que moldean el campo. La transparencia se considera un estándar fundamental que mejora la calidad del desarrollo, obligando a los equipos a adherirse a normas más estrictas en cuanto a datos y construcción. Sin embargo, esta apertura presenta riesgos significativos, ya que los modelos accesibles pueden ser mal utilizados para generar desinformación, discurso de odio o malware. El desafío central radica en equilibrar los beneficios de la innovación visible y impulsada por la comunidad frente al potencial de aplicaciones dañinas, requiriendo una cuidadosa negociación entre seguridad y apertura en la búsqueda de un progreso ético en la inteligencia artificial. Este artículo es crucial para open_data porque destaca cómo los conjuntos de datos accesibles y de alta calidad son la base de la investigación reproducible en inteligencia artificial. Demuestra que compartir datos crudos permite la verificación independiente y una participación más amplia, principios centrales del movimiento de datos abiertos. Además, subraya la responsabilidad que conlleva el acceso a los datos, mostrando que las iniciativas de datos abiertos también deben abordar las implicaciones sociales de la tecnología construida sobre ellos.
Source: technologyreview.comPublished on 2024-07-25