OpenAI wants to work with organizations to build new AI training data sets

OpenAI ha lanzado las Asociaciones de Datos para abordar los sesgos culturales y lingüísticos inherentes a los datos de entrenamiento de orientación occidental. Al colaborar con instituciones de terceros, la compañía tiene como objetivo crear conjuntos de datos diversos que reflejen mejor las sociedades, idiomas y ámbitos globales. Esta iniciativa busca superar las limitaciones de los corpus existentes basados en Internet, que a menudo amplifican el lenguaje tóxico y las perspectivas estrechas, incorporando contenido especializado que no es fácilmente accesible en línea. El programa implica la digitalización y curación de datos a través de asociaciones con organizaciones como gobiernos y entidades legales, asegurando que los modelos comprendan industrias y culturas específicas. OpenAI planea lanzar tanto conjuntos de datos abiertos de código fuente como privados para sus modelos propietarios. Este enfoque dual permite a los socios mantener el control sobre la información sensible mientras contribuyen a sistemas de IA que ofrecen una comprensión más amplia e inclusiva. El objetivo es mejorar la utilidad y seguridad de la IA al exponerla a una amplia gama de intenciones y experiencias humanas. Este esfuerzo es relevante para los datos abiertos, ya que destaca la necesidad crítica de conjuntos de datos inclusivos y representativos para mitigar el sesgo en la inteligencia artificial. Sin embargo, también plantea preguntas sobre transparencia, compensación y las motivaciones comerciales detrás de la recopilación de datos. A medida que el panorama de la IA evoluciona, garantizar que las contribuciones de datos sean éticas y beneficiosas para todas las partes interesadas sigue siendo un desafío significativo tanto para la comunidad de datos abiertos como para los desarrolladores.

Source: businessghana.com
Published on 2023-11-13