Nueva IA china gratis que iguala a GPT y Gemini: ¿el fin de Google?

Servidor con varias GPU instaladas en rack de centro de datos, iluminación neutra, ilustrando el hardware necesario para ejec
Publicidad

Una IA china gratis que exige 700 GB de memoria para funcionar​

¿Se puede competir con GPT-5.1 Pro y Gemini-3 Pro sin pagar ni un céntimo y sin conexión a internet? La respuesta que circula es que sí, siempre que el interesado disponga de un servidor con ocho GPU H100, casi 700 GB de VRAM y unos 50.000 euros de presupuesto. El modelo se descarga, se ejecuta en local y no requiere ni suscripción ni nube. El entusiasmo por la soberanía tecnológica choca de frente con la factura del hardware.

La discusión arranca con un modelo abierto publicado por un laboratorio chino y con la tesis de que su llegada gratuita busca presionar a la baja la valoración bursátil de las tecnológicas estadounidenses. El archivo se descarga desde repositorios públicos y se ejecuta con programas independientes, como cualquier base de datos. No hay telemetría, no hay cuota mensual y no hay corte de servicio cuando el proveedor decide cambiar las condiciones.

Qué hace falta para ejecutar la IA china en local​

El requisito técnico es el gran filtro. Con 678.000 millones de parámetros y una cuantización de 8 bits, el modelo consume cerca de 700 GB de memoria de GPU. En FP16 o FP32 la cifra se dispara y obliga a instancias del tipo p5.48xlarge de Amazon: 192 vCPU, 2 TiB de RAM, ocho H100 con 640 GB de HBM3 y 3.200 Gbps de red EFA. El alquiler por hora de esa configuración convierte la prueba en un ejercicio caro.

Hay quien rebaja el cálculo y sostiene que para una empresa mediana 50.000 euros no son nada y se amortizan en poco tiempo. La objeción llega desde el otro lado: si se quieren requisitos razonablemente comparables, la horquilla realista se mueve entre 250.000 y 500.000 dólares solo en hardware, más el tiempo de trabajo asociado. La diferencia entre ambas estimaciones no es menor: separa un capricho de departamento de una inversión estratégica.
Publicidad

El coste real de montar un servicio de IA para miles de usuarios​

La experiencia de quien lo ha intentado en una empresa aporta el dato que suele faltar. Se estudió desplegar un servicio de IA por API para miles de usuarios simultáneos y el coste multiplicaba por cien la estimación inicial. No era mover un modelo, era dimensionar capacidad para atender a mucha gente a la vez. El proyecto se descartó de inmediato. Ese cálculo desglosado, con sus partidas, es el material que no aparece en las notas de prensa.

La versión que se ejecuta en local tampoco es la misma que la que se prueba en la web. Un modelo destilado de 70.000 millones de parámetros no equivale al modelo en bruto. De ahí que las comparaciones de rendimiento dependan de qué variante se haya descargado y con qué cuantización. La pregunta que muchos se hacen al instalar el archivo es cómo se actualiza sin conexión: la respuesta es manual, copiando el nuevo archivo a la carpeta correspondiente.

La guerra comercial detrás de una descarga gratuita​

El movimiento tiene lectura geopolítica. China habría prohibido a sus empresas comprar chips de Nvidia, lo que supone un golpe para el fabricante, que tenía más del 15% de su cuota de mercado en el país. La estrategia de regalar modelos abiertos se interpreta como una forma de provocar a las tecnológicas estadounidenses y de tensar la cadena de suministro. Quien gana con todo esto, se argumenta, es Nvidia: todos pagan GPU, desde los laboratorios hasta los gigantes de internet.

La otra cara es la privacidad. Un modelo que se ejecuta sin conexión no envía datos a ningún servidor, pero la duda persiste sobre qué ocurre si el equipo se conecta aunque sea un segundo. La acusación de que el modelo filtra información al gobierno chino circula sin pruebas aportadas. Lo que sí está documentado es que el programa de ejecución es independiente del archivo del modelo y que la ejecución puede ser 100% offline.

Rendimiento real frente a la promesa de igualar a GPT-5.1​

La comparación con los modelos de pago genera división. Hay quien lo ha probado durante semanas y lo califica de excelente. Otros sostienen que ni se acerca a GPT-5.1 y que quienes afirman lo contrario no han usado la versión correcta. Un usuario relata que al preguntarle por su propia versión el modelo responde que no tiene nombre de versión, lo que alimenta las sospechas sobre qué se está ejecutando realmente.

El problema de fondo es que el modelo tiende a inventar lo que no ha aprendido en el entrenamiento, un handicap reconocido. Para chat funciona bien; para programación o para integrarlo en un robot que ejecute tareas laborales, el consenso es que todavía falta. La versión disponible en la web es la 3.2, y la comparación con las alternativas estadounidenses depende de si se usa la variante destilada o el modelo completo.



La descarga es gratis y el hardware no. Con estos números, la adopción masiva debería ser inmediata. Sigue siendo cosa de unos pocos.
💬 LO QUE DICEN LOS FOREROS
«Los chinos siguen progresando, el nuevo modelo gasta menos en computación pero sigue siendo un LLM, y para chats funcionan muy bien pero para programación o meterlo dentro de un robot y que haga tareas laborales, eso todavía falta.»
— workforfood · limitaciones del modelo chino
«Si los requisitos con razonablemente comparables, estamos hablando de 250-500K$ Solo en hardware, para 'ver si funciona bien'. Más tiempo trabajo y cosas de esas.»
— pepeleches · coste real del hardware
«Se actualiza descargando la nueva versión del modelo, como si te descargaras un documento. Se puede hacer de forma manual, copiando el archivo del modelo a la carpeta correspondiente. La ejecución es 100% offline.»
— teperico · funcionamiento sin conexión
📊 OPINIONES
Peso aproximado de cada postura en el debate. No es una encuesta.
IA china gratis para hundir a EEUU40%
No iguala a GPT-5.1 ni de lejos35%
El coste real lo hace inviable25%
📌 DATOS
678.000 millones de parámetros y cerca de 700 GB de VRAM con cuantización de 8 bits
Instancia p5.48xlarge de Amazon: 192 vCPU, 2 TiB de RAM, 8 GPU H100 y 640 GB de HBM3
La versión disponible en la web es la 3.2
❓ PREGUNTAS FRECUENTES
¿Cómo se actualiza un modelo de IA que funciona sin conexión?
Descargando la nueva versión del archivo del modelo, como si fuera un documento, y copiándola a la carpeta correspondiente. El programa de ejecución es independiente del modelo, por lo que basta con reemplazar el archivo. La ejecución posterior es 100% offline y no requiere ninguna conexión a internet.
📅 EVOLUCIÓN
Abril 2025 Se publica el modelo abierto y se abre el debate sobre su ejecución en local
Abril 2025 Se confirma que China prohíbe a sus empresas comprar chips de Nvidia
Abril 2025 Se calcula que el hardware necesario para requisitos comparables cuesta entre 250.000 y 500.000 dólares
Abril 2025 Se documenta que la versión disponible en la web es la 3.2 y que el modelo tiende a inventar datos
🔗 FUENTES
Xataka ↗
Artículo de referencia sobre el modelo y su descarga
Financial Times ↗
Información sobre la prohibición china de chips Nvidia
💬 POR QUÉ PARTICIPAR
✓El desglose de la instancia p5.48xlarge de Amazon con sus 192 vCPU, 2 TiB de RAM y ocho H100, partida a partida
✓El cálculo de una empresa que estudió montar un servicio de IA por API para miles de usuarios y vio cómo el coste se multiplicaba por cien
✓La distinción entre el modelo destilado de 70.000 millones de parámetros y el modelo en bruto de 678.000 millones
Este es un resumen del hilo. La discusión completa incluye 99 respuestas con datos, fuentes y análisis que solo están disponibles para usuarios registrados. Crea tu cuenta en 30 segundos para acceder al debate completo y participar.
Descargo de responsabilidad: Las cifras de hardware y costes proceden de estimaciones y cálculos publicados en el debate, no de presupuestos oficiales.
Te estás perdiendo 99 mensajes
Esto es un resumen. El hilo original está entero ahí dentro.
Leer el hilo completo →
Registro en 30 segundos
Resumen elaborado con IA a partir del debate de la comunidad — 99 respuestas analizadas. Última actualización: .

Estadísticas del foro

Temas
2.055.067
Mensajes
58.305.617
Miembros
190.964
Último miembro
Cascada

El blog de burbuja.info

Volver