OpenAI inks deal to train AI on Reddit data
OpenAI y Reddit han formalizado una alianza que otorga a OpenAI acceso al vasto archivo de la plataforma social, compuesto por contenido generado por los usuarios en tiempo real, para entrenar sus modelos de inteligencia artificial. Este acuerdo permite a Reddit integrar características avanzadas de IA en su ecosistema, mientras transforma las herramientas conversacionales de OpenAI en sistemas capaces de comprender y utilizar mejor el discurso humano único y estructurado. El acuerdo representa una expansión estratégica para OpenAI, al asegurar fuentes de datos de alta calidad, y permite a Reddit aprovechar los modelos de lenguaje de gran escala para mejorar la experiencia del usuario y el apoyo a los moderadores. Esta colaboración destaca el creciente valor económico del texto generado por humanos en la era de la IA generativa, ya que las empresas compiten por contenido auténtico para diferenciar sus resultados del material producido por máquinas. Al licenciar estos datos, Reddit diversifica sus fuentes de ingresos más allá de la publicidad tradicional, aprovechando el alto valor que se le atribuye a la conversación genuina entre personas. Para la comunidad de datos abiertos, esto plantea preguntas críticas sobre la propiedad de los datos, el consentimiento y la mercantilización de los espacios digitales públicos, ya que las plataformas están tratando cada vez más las contribuciones de los usuarios como activos propietarios para el desarrollo comercial de IA, en lugar de recursos compartidos del dominio público. El acuerdo también subraya la tensión entre la monetización de las plataformas y la autonomía de los usuarios, ilustrada por la supresión por parte de Reddit de los esfuerzos comunitarios para controlar colectivamente el uso de los datos. Dado que los modelos de IA dependen en gran medida de este tipo de datos extraídos o licenciados, la falta de mecanismos transparentes que permitan a los individuos optar por no participar o beneficiarse de esta comercialización plantea importantes desafíos éticos. Este caso sirve como un ejemplo crucial para los defensores de los datos abiertos, demostrando cómo las grandes empresas tecnológicas están remodelando el panorama digital al centralizar el control sobre la información, lo que potencialmente margina la agencia de los usuarios y complica los esfuerzos por establecer estándares equitativos y abiertos para el uso de datos en el entrenamiento de IA.
Source: businessghana.comPublished on 2024-05-19