How this grassroots effort could make AI voices more diverse

El proyecto Common Voice demuestra un cambio significativo hacia una inteligencia artificial inclusiva, al priorizar idiomas subrepresentados como el kiswahili. Al involucrar a diversos grupos demográficos, incluidas mujeres rurales y no alfabetizadas, la iniciativa captura matices culturales ricos que a menudo están ausentes en los conjuntos de datos dominados por el inglés. Este enfoque subraya que preservar el idioma es, en esencia, salvaguardar la identidad, el patrimonio y los contextos culturales específicos que resisten una traducción sencilla. Sin embargo, la naturaleza de acceso abierto de estos datos introduce complejas tensiones éticas. Aunque los voluntarios donan sus voces para garantizar que sus comunidades estén representadas, ceden el control sobre su uso futuro, lo que genera preocupaciones sobre la explotación corporativa. Las grandes empresas tecnológicas pueden utilizar libremente estas grabaciones, obtenidas tras grandes esfuerzos, para desarrollar productos comerciales sin otorgar crédito ni beneficios directos a los contribuyentes originales, lo que pone de manifiesto un posible desequilibrio de poder entre los esfuerzos comunitarios y las ganancias de la industria tecnológica. Esta tensión es crucial en el debate sobre los datos abiertos, ya que cuestiona la suposición de que la accesibilidad siempre equivale a empoderamiento. El artículo ilustra que, si bien los conjuntos de datos abiertos ayudan a corregir los sesgos históricos en el entrenamiento de la IA, también corren el riesgo de facilitar la apropiación, especialmente de grupos marginados. Esto obliga a una reevaluación de las políticas de datos abiertos para abordar mejor la soberanía, el consentimiento y la distribución equitativa de beneficios, asegurando que la inclusividad no conduzca inadvertidamente a la explotación.

Source: technologyreview.com
Published on 2024-11-16