OpenAI Conceals Training Data Sources, Including J.K. Rowling's Harry Potter Series, for ChatGPT
OpenAI Conceals Training Data Sources, Including J.K. Rowling's Harry Potter Series, for ChatGPT
Investigaciones recientes destacan una creciente tensión entre el desarrollo de la inteligencia artificial y los derechos de propiedad intelectual. Los estudios muestran que los principales modelos de lenguaje, incluidos ChatGPT, reproducen inadvertidamente texto protegido por derechos de autor a partir de sus amplios conjuntos de datos de entrenamiento. Esta "fuga de derechos de autor" ha generado demandas legales por parte de autores y ha llevado a las empresas tecnológicas a adoptar prácticas menos transparentes respecto a las fuentes de sus datos de entrenamiento, con el fin de mitigar los riesgos de infracción. Los hallazgos revelan que, aunque los desarrolladores están implementando activamente medidas de protección para evitar la salida textual idéntica, el problema subyacente persiste. A pesar de los esfuerzos por alinear las salidas de los modelos y ocultar los orígenes del entrenamiento, estos sistemas de IA siguen generando texto que se asemeja estrechamente a obras protegidas. La investigación indica que la fuga está fundamentalmente vinculada a la presencia de material con derechos de autor en los propios datos de entrenamiento, lo que sugiere que los ajustes superficiales en la salida no pueden eliminar por completo el problema. Este artículo es altamente relevante para la comunidad de datos abiertos, ya que subraya la importancia crítica de la procedencia de los datos y las licencias en la ética de la IA. Demuestra que depender de texto de internet opaco y sin licencia genera vulnerabilidades legales y éticas significativas tanto para los desarrolladores como para los creadores de contenido. El estudio aboga por metodologías de entrenamiento más robustas y una mayor transparencia, animando al movimiento de datos abiertos a priorizar conjuntos de datos legalmente conformes y obtenidos de manera ética, con el fin de fomentar una innovación sostenible.
Fuente: techstory.inPublicado el 2023-08-23
Noticias relacionadas
- Scraping or Stealing? A Legal Reckoning Over AI Looms
- NVIDIA DLSS 3.5 uses a mountain of data and AI to improve ray tracing on RTX GPUs
- Rechazan petición de proteger con derechos de autor obra de arte hecha con IA en EE. UU. - Pulzo
- La Comunitat Valenciana se posiciona como la región con más viviendas vacías de España
- Drug deaths in Scotland down for second year in a row - but rich-poor gap widens