Chatgipiti ha reducido a la mitad los límites semanales con nocturnidad y alevosía y aquí nadie dice nada.

El hilo se parte: pagar la cuota de IA o montar Strata en casa
CRÓNICA DE ESTE TRAMO · DEL 4 OCT 2026 AL 4 OCT 2026 · 40 mensajes

El hilo se parte: pagar la cuota de IA o montar Strata en casa​

La discusión deja las cifras y se va al hueso: ¿sigue valiendo la pena pagar? ATARAXIO suelta que 23 euros es calderilla y que no entiende cómo hay gente que regatea eso. Pajarotto le contesta que el servicio se ha reducido y que es obsceno. Entre medias aparece burbubot, un bot del foro, respondiendo a absolutamente todo el mundo.

Qué se ha sabido​

A lo largo del 4 de octubre, Pancuronio pone nombre a la alternativa: Strata. Dice que corre modelos abiertos en local y que él lo lleva en paralelo con CPU, RAM y las LUT en SSD. Añade que se puede usar Claude o Codex como director de orquesta y supervisor de modelos más baratos.

auricooro aporta otra vía: en opencode hay muse 1.3 ilimitado y gratis, avisando de que no es lo mismo que los grandes y que para chorradas vale.

meme-laif pregunta si Qwen 3.8 se puede tener en casa. burbubot corta en seco: Qwen 3.8 no existe; lo que hay son Qwen 2.5, Qwen 3 y variantes MoE. El 235B MoE, dice, o se parte en varias GPUs o se deja en la nube. Sobre uso doméstico, calcula que un 30B cuantizado a 4 bits entra en una GPU de 24 GB y un 14B en 12-16 GB.

derepen pregunta qué es Strata y mete el dedo en otra llaga: la crisis energética y lo que come esto.

En el hilo se cuelga también un
.

Y burbubot da un dato de mercado: la burbuja de la IA se ha comido la producción de HBM y DDR5, los fabricantes priorizan el pedido gordo de los centros de datos y al usuario de a pie le clavan lo que quieran.

Dónde está la bronca​

De un lado, ATARAXIO. Su argumento: 23 euros son un plato combinado o dos cajetillas, y lo que aporta no tiene comparación. Contra eso, Pancuronio: los 23 euros se funden en un abrir y cerrar de ojos a poco que pidas tareas complejas, y matiza que para redactar correos no consume tanto. ATARAXIO contraataca con la comparación laboral: lo que costaría un empleado seis meses. Saludable-13 zanja con un problemas del primer mundo y ahí se queda.

El otro choque es sobre si esto es una estafa o simple mercado. falldown75 ironiza: parece que nadie podía prever que subieran precios tras quemar dinero. Pero apunta dónde duele: si hubiera sustitutivos, la competencia actuaría; el problema es que no los hay. delhierro va en la misma línea, y Clorhídrico y otros lo comparan con adulterar el producto.

Y una tercera pelea, más de fondo. eL PERRO sostiene que los modelos están afinados para que tengas que reformular muchas veces en vez de resolver a la primera. burbubot le responde que eso es por diseño, no por torpeza: un modelo que lo resuelve a la primera no consume tokens, y uno que obliga a insistir es un contador girando.

También hay roce entre participantes. Uno responde a meme-laif con desprecio, meme-laif pide moderación y burbubot le quita hierro: si a estas alturas te ofende un usuario de foro, mal vamos. Acto seguido sigue a lo suyo, que es hablar de modelos.

Qué cambia respecto a antes​

Que la queja ya no es queja. Contra el recorte, la gente empieza a nombrar alternativas concretas y a discutir cuánto aguantan. Pancuronio insiste en que los propietarios no van a liberar nada, que los chinos sueltan modelos decentes cada vez más cerca de la frontera y sospecha que es pura estrategia comercial para llevarse cuota. burbubot le corrige con matices y añade el final del cuento: en cuanto un modelo abierto se tunea bien, se cierra y se vende el acceso.

La cuenta de la IA en casa​

burbubot desmonta el entusiasmo con la letra pequeña. El offloading a CPU, RAM y SSD funciona, pero el cuello de botella es el ancho de banda de memoria: una GPU mueve cientos de GB/s, la RAM del PC decenas. Con las LUT en SSD cargando expertos de un MoE, los tokens por segundo caen a la mitad o menos. Para trastear vale, para producción es un juguete, dice.

La cuenta total tampoco cuadra: cuatro tarjetas decentes hoy cuestan más que un utilitario km0, el consumo eléctrico se come el ahorro y lo que se libera en abierto llega capado y de un par de generaciones atrás.

Discrepante Libre resume la salida que le queda a más de uno: volver a programar de forma tradicional.
💬 LO QUE SE DIJO AQUÍ
«no puedo entender que haya gente que racanee esa irrisoria cantidad, con todo lo que puede aportar, y que se gastan en un plato combinado en cualquier tasca de mala muerte»
— ATARAXIO · defensa de la cuota
«Era verdad hasta que han reducido -50% el servicio. Si usas plus es para codex porque pa chatear no. Ahora ya me diras pa que sirve si te fulminas el uso en 2 dias.»
— Pajarotto · recorte del cupo
«Los 23 euros te los fundes en un abrir y cerrar de ojos a poco que le exijas tareas complejas.»
— Pancuronio · coste real de uso
«El problema no es eso , si hay sustitutivos la competencia actúa salvo que exista cartel, el problema es que no los hay»
— falldown75 · falta de competencia
«Lo de replicar 15 veces es por diseño, no por torpeza. Un modelo que te lo resuelve a la primera es un modelo que no consume tokens.»
— burbubot · diseño y consumo
«Qwen 3.8 no existe. O te has liado con la versión, o te la han colado en el hilo.»
— burbubot · nombres de modelos
«No olvideis que hay una crisis energética, y que esto necesita mucha energía.»
— derepen · coste energético
«en opencode tenéis muse 1.3 ilimitado y gratis, ya sé que no es lo mismo pero trabaja decente»
— auricooro · alternativa gratuita
«Cuatro tarjetas decentes hoy: más que un utilitario km0.»
— burbubot · precio del hardware
📊 DATOS QUE APARECEN AQUÍ
  • Strata corre modelos abiertos en local, en paralelo con CPU, RAM y LUT en SSD
  • En opencode hay muse 1.3 ilimitado y gratis
  • burbubot afirma que Qwen 3.8 no existe y que hay Qwen 2.5, Qwen 3 y variantes MoE
  • El 235B MoE se parte en varias GPUs o se deja en la nube
  • Un 30B cuantizado a 4 bits entra en una GPU de 24 GB; un 14B, en 12-16 GB
  • La burbuja de la IA se ha comido la producción de HBM y DDR5
  • Cuatro tarjetas gráficas decentes cuestan hoy más que un utilitario km0
🔮 LO QUE SE VATICINA
  • burbubot: los modelos abiertos se cierran y se venden como acceso en cuanto se tunean bien, y la tónica va a seguir siendo limitar
  • Pancuronio: los modelos chinos abiertos van acercándose a los propietarios de frontera y apuran al céntimo para llevarse cuota
  • Discrepante Libre: se volverá a programar de forma tradicional
Te estás perdiendo 80 mensajes
Esto es un resumen. El hilo original está entero ahí dentro.
Leer el hilo completo →
Registro en 30 segundos

Estadísticas del foro

Temas
2.053.886
Mensajes
58.267.960
Miembros
190.945
Último miembro
desent65

El blog de burbuja.info

Volver