OpenAI ha identificado indicios de que la startup china DeepSeek empleó una técnica llamada "destilación" para entrenar su modelo de código abierto utilizando resultados de los propios modelos de OpenAI. Esta práctica implica extraer conocimiento de modelos grandes y costosos para crear competidores más eficientes y baratos. Aunque la destilación es común en la industria, OpenAI la considera una violación de sus términos de servicio, ya que prohíbe explícitamente usar sus salidas para desarrollar productos que compitan directamente con la compañía. El lanzamiento de los modelos de DeepSeek, que alcanzaron un rendimiento comparable a los líderes estadounidenses con una fracción del costo de hardware y energía, provocó una reacción significativa en los mercados tecnológicos. Esta eficiencia ha generado temores sobre la obsolescencia de las enormes inversiones en infraestructura de computación de alto rendimiento, afectando temporalmente la valoración de empresas clave como Nvidia. La situación resalta la creciente capacidad de desarrolladores con recursos limitados para igualar a los gigantes tecnológicos mediante estrategias de optimización de datos. Este conflicto es fundamental para el ecosistema de datos abiertos, pues ilustra la tensa relación entre la innovación colaborativa y la protección de la propiedad intelectual. Mientras algunos expertos argumentan que aprovechar los outputs de modelos alineados es una práctica académica y comercial estándar, OpenAI insiste en la necesidad de salvaguardar sus activos tecnológicos. El caso subraya los desafíos legales y éticos para definir los límites del uso de datos derivados en el entrenamiento de IA, afectando cómo las empresas pueden compartir o retener conocimiento en un mercado globalizado.
Source: df.clPublished on 2025-01-30