Harvard and Google to release 1 million public-domain books as AI training dataset | TechCrunch

Harvard and Google to release 1 million public-domain books as AI training dataset | TechCrunch

La Universidad de Harvard está lanzando la Iniciativa de Datos Institucionales para democratizar el acceso a vastos conjuntos de datos de libros de dominio público destinados al entrenamiento de inteligencia artificial. Con el respaldo de Microsoft y OpenAI, este proyecto tiene como objetivo reducir las barreras para investigadores y startups, disminuyendo la ventaja financiera que actualmente ostentan las grandes empresas tecnológicas. Este esfuerzo apoya directamente la apertura de datos al crear un canal confiable y legal para textos de dominio público. Garantiza que los recursos críticos de entrenamiento sean accesibles para la comunidad científica en general, en lugar de ser monopolizados por corporaciones con grandes recursos, fomentando así un panorama más equitativo en el desarrollo de la inteligencia artificial. Al poner millones de libros a disposición del aprendizaje automático, la iniciativa promueve la transparencia y la inclusividad en la investigación de inteligencia artificial. Esta alineación con los principios de datos abiertos fomenta una participación más amplia y la innovación, asegurando que los beneficios de la inteligencia artificial avanzada no queden restringidos a unas pocas entidades bien financiadas.

Fuente: techcrunch.com
Publicado el 2024-12-13