OpenAI’s Mira Murati is “not sure” where Sora’s training data comes from
OpenAI’s Mira Murati is “not sure” where Sora’s training data comes from
La directora de tecnología de OpenAI, Mira Murati, admitió su incertidumbre sobre las fuentes de datos precisas utilizadas para entrenar el modelo de generación de video Sora, afirmando únicamente que este se basa en información de acceso público o con licencia. Esta falta de transparencia es significativa porque destaca la ambigüedad persistente en torno a cómo las principales empresas de inteligencia artificial construyen sus modelos fundamentales. Para los defensores de los datos abiertos, este incidente subraya la necesidad crítica de contar con documentación clara y accesible de los conjuntos de datos de entrenamiento. La situación se produce en medio de una creciente presión legal y demandas por derechos de autor contra OpenAI, incluidas demandas presentadas por autores y The New York Times. Estos desafíos enfatizan la tensión entre el uso de vastas cantidades de datos de internet para el desarrollo de la IA y el respeto a los derechos de propiedad intelectual y privacidad. La dependencia de datos públicos no definidos plantea interrogantes sobre la responsabilidad y la procedencia ética de la información. Esta ambigüedad es particularmente relevante para la comunidad de datos abiertos, que aboga por la transparencia en los procesos algorítmicos. Cuando el origen de los datos no está claro, resulta difícil evaluar sesgos, legalidad o cumplimiento ético. En última instancia, la controversia en torno a Sora ilustra por qué los estándares abiertos para el uso de datos son esenciales para generar confianza y garantizar un desarrollo responsable de la inteligencia artificial en un entorno cada vez más regulado.
Fuente: cointelegraph.comPublicado el 2024-03-17
Noticias relacionadas
- Hiding behind fees isn’t what FOIA is all about
- Worldcoin: expertos dicen si es peligroso darle datos biométricos
- TrialAssure Launches Anonymize 3.0 Technology for an Improved Data and Document Anonymization User Experience in Pharma and Beyond | BioPharma Dive
- No politizar derechos de acceso a información