OpenAI sospecha que DeepSeek destiló su IA para entrenar su modelo
Una startup china presenta un modelo de código abierto que sacude los mercados. Días después, OpenAI y Microsoft investigan si ese modelo se entrenó con las respuestas de ChatGPT. La técnica se llama destilación y, según las primeras pesquisas, habría cuentas bloqueadas por usarla. El episodio ha dejado una pregunta incómoda: ¿cuánto de milagro tecnológico y cuánto de copia hay en el nuevo rival?
La destilación, explicada sin humo
La destilación es un método conocido en el sector: un modelo grande y caro, el profesor, genera respuestas que sirven para entrenar a otro más pequeño, el estudiante. El objetivo es que el alumno rinda parecido gastando menos. Si el dueño de ambos modelos es el mismo, el proceso es legítimo. El problema aparece cuando un tercero usa la API de un modelo ajeno para fabricar su propio producto. Los términos de OpenAI prohíben usar sus salidas para «desarrollar modelos que compitan con OpenAI».
Según el
Financial Times, OpenAI habría detectado indicios de que DeepSeek accedió a sus datos por esa vía.
Bloomberg añadió que OpenAI y Microsoft investigaban si la startup china usó la API para destilar. Las dos empresas habrían bloqueado cuentas sospechosas el año anterior. El zar de la IA designado por Trump, David Sacks, habló de «evidencia sustancial» y anticipó que las grandes tecnológicas estadounidenses empezarán a tomar medidas para «prevenir la destilación».
El detalle que delata al alumno
Las pruebas que circulan no son solo corporativas. Un análisis difundido en el sector señala que, ante un reto de programación rebuscado, el modelo chino calca la respuesta de ChatGPT mientras las soluciones de otros competidores divergen por completo. La comparación es la de dos exámenes con los mismos errores raros: si dos alumnos fallan igual en lo mismo, la sospecha de copia es razonable. A eso se suma un episodio llamativo: preguntado por sus diferencias con ChatGPT, el modelo respondió que ambos habían sido desarrollados por OpenAI. Después lo llamó malentendido.
El asunto tiene una derivada política. La Casa Blanca confirmó que el Consejo de Seguridad Nacional revisaba el impacto de la aplicación, y su portavoz lo describió como una llamada de atención para la industria estadounidense. En paralelo, la autoridad de protección de datos de Italia pidió detalles sobre el uso de datos personales y la aplicación dejó de estar disponible en las tiendas de Apple y Google en ese país. Irlanda también solicitó información.
¿Por qué se discute si no hay chips?
El argumento más repetido en contra del relato del milagro chino es material: entrenar un modelo de frontera exige una potencia de cálculo que, con las restricciones de exportación vigentes, resulta difícil de conseguir. De ahí que una parte del análisis sostenga que el avance solo se explica por aprovechar el trabajo ajeno. La cifra que circula en algunos medios apunta a que el desarrollo habría requerido 1.600 millones y más de 50.000 GPU de NVIDIA, un coste muy superior al sugerido en la presentación pública.
La defensa del modelo chino se apoya en su carácter abierto. El código disponible permitiría auditar cómo se construyó. La objeción es inmediata: ningún actor con una ventaja tecnológica relevante regala su arma. Si el código se libera, se argumenta, es porque no había nada que proteger o porque el material de partida venía de fuera.
Lo que la censura revela del entrenamiento
Hay un terreno donde el comportamiento del modelo se vuelve más elocuente que cualquier comunicado. Preguntas sobre Xinjiang, sobre campos de internamiento o sobre la propia existencia de Xi Jinping activan bloqueos y respuestas evasivas. Para una parte del sector, esa capa de filtros ideológicos sugiere un trabajo de ajuste sobre una base ajena: el esfuerzo se habría concentrado en tapar, no en construir. La primera regla de una IA creíble es no tomar por tonto al usuario, y los filtros burdos hacen lo contrario.
El episodio también ha dejado damnificados en los mercados. La irrupción del modelo provocó una sacudida en las acciones de NVIDIA, que no solo vive de la IA: es el principal suministrador de tarjetas gráficas para videojuegos y suena para la próxima consola de Nintendo. La lectura más extendida entre quienes siguen el sector es que la caída fue una sobrerreacción, porque el propio modelo chino se entrenó con hardware de NVIDIA.
Queda la pregunta de fondo, la que no resuelve ningún comunicado: si el modelo es tan abierto y tan barato, ¿por qué nadie con ventaja real lo regala? La respuesta, a día de hoy, sigue en el aire.