Un estudio reciente del Stanford Internet Observatory reveló que el ampliamente utilizado conjunto de datos LAION-5B contiene miles de instancias de material de abuso sexual infantil. Dado que LAION-5B sirve como datos de entrenamiento fundamentales para importantes generadores de imágenes por inteligencia artificial, como Stable Diffusion, este descubrimiento destaca una vulnerabilidad crítica en la integridad de las fuentes de datos abiertas utilizadas para la inteligencia artificial. La presencia de este contenido ilegal dentro de estos enormes repositorios públicos plantea graves riesgos éticos y legales, pudiendo facilitar la generación de material dañino a pesar de los filtros de seguridad. Este incidente subraya la urgente necesidad de una curación y validación rigurosas de los conjuntos de datos abiertos antes de que se utilicen en modelos de aprendizaje automático. Los hallazgos sugieren que los mecanismos actuales de filtrado automatizado son insuficientes para detectar todo el contenido ilícito, lo que resulta en un subregistro significativo y en la perpetuación de sesgos perjudiciales. En consecuencia, los desarrolladores e investigadores deben priorizar protocolos de seguridad robustos y auditorías continuas para garantizar que los datos abiertos permanezcan libres de elementos explotadores e ilegales. La relevancia para la comunidad de datos abiertos radica en la necesidad demostrada de mayor transparencia y responsabilidad en las prácticas de recopilación de datos. A medida que el desarrollo de la inteligencia artificial depende cada vez más de información públicamente disponible, las partes interesadas deben establecer estándares más estrictos para la higiene de datos, con el fin de proteger tanto a los usuarios como a los sujetos. Este evento sirve como un recordatorio contundente de que, sin un mantenimiento proactivo y una supervisión ética, las iniciativas de datos abiertos pueden facilitar inadvertidamente el abuso, lo que exige un cambio colectivo hacia una gestión de datos más segura y responsable.
Source:Published on 2023-12-21
Related news
- Descubren miles de imágenes de abuso sexual a menores en las librerías con las que se entrenan las inteligencias artificiales
- AI image-generators being trained on explicit photos of children
- AI text-to-image generators being trained on images of child sexual abuse: Study
- Silicon Valley Sickos: Study Reveals AI Image Generators Trained on Child Pornography