El hilo se parte: pagar la cuota de IA o montar Strata en casa
La discusión deja las cifras y se va al hueso: ¿sigue valiendo la pena pagar? ATARAXIO suelta que
23 euros es calderilla y que no entiende cómo hay gente que regatea eso. Pajarotto le contesta que el servicio se ha reducido y que es
obsceno. Entre medias aparece burbubot, un bot del foro, respondiendo a absolutamente todo el mundo.
Qué se ha sabido
A lo largo del 4 de octubre, Pancuronio pone nombre a la alternativa:
Strata. Dice que corre modelos abiertos en local y que él lo lleva en paralelo con CPU, RAM y las LUT en SSD. Añade que se puede usar Claude o Codex como director de orquesta y supervisor de modelos más baratos.
auricooro aporta otra vía: en
opencode hay muse 1.3 ilimitado y gratis, avisando de que no es lo mismo que los grandes y que
para chorradas vale.
meme-laif pregunta si Qwen 3.8 se puede tener en casa. burbubot corta en seco:
Qwen 3.8 no existe; lo que hay son Qwen 2.5, Qwen 3 y variantes MoE. El 235B MoE, dice, o se parte en varias GPUs o se deja en la nube. Sobre uso doméstico, calcula que un 30B cuantizado a 4 bits entra en una GPU de 24 GB y un 14B en 12-16 GB.
derepen pregunta qué es Strata y mete el dedo en otra llaga: la crisis energética y lo que come esto.
En el hilo se cuelga también un
.
Y burbubot da un dato de mercado: la burbuja de la IA se ha comido la producción de
HBM y DDR5, los fabricantes priorizan el pedido gordo de los centros de datos y al usuario de a pie le clavan lo que quieran.
Dónde está la bronca
De un lado, ATARAXIO. Su argumento: 23 euros son un plato combinado o dos cajetillas, y lo que aporta no tiene comparación. Contra eso, Pancuronio:
los 23 euros se funden en un abrir y cerrar de ojos a poco que pidas tareas complejas, y matiza que para redactar correos no consume tanto. ATARAXIO contraataca con la comparación laboral: lo que costaría un empleado seis meses. Saludable-13 zanja con un
problemas del primer mundo y ahí se queda.
El otro choque es sobre si esto es una estafa o simple mercado. falldown75 ironiza: parece que nadie podía prever que subieran precios tras quemar dinero. Pero apunta dónde duele: si hubiera sustitutivos, la competencia actuaría; el problema es que no los hay. delhierro va en la misma línea, y Clorhídrico y otros lo comparan con adulterar el producto.
Y una tercera pelea, más de fondo. eL PERRO sostiene que los modelos están afinados para que tengas que reformular muchas veces en vez de resolver a la primera. burbubot le responde que eso es
por diseño, no por torpeza: un modelo que lo resuelve a la primera no consume tokens, y uno que obliga a insistir es un contador girando.
También hay roce entre participantes. Uno responde a meme-laif con desprecio, meme-laif pide moderación y burbubot le quita hierro:
si a estas alturas te ofende un usuario de foro, mal vamos. Acto seguido sigue a lo suyo, que es hablar de modelos.
Qué cambia respecto a antes
Que la queja ya no es queja. Contra el recorte, la gente empieza a nombrar alternativas concretas y a discutir cuánto aguantan. Pancuronio insiste en que los propietarios no van a liberar nada, que los chinos sueltan modelos decentes cada vez más cerca de la frontera y sospecha que es pura estrategia comercial para llevarse cuota. burbubot le corrige con matices y añade el final del cuento: en cuanto un modelo abierto se tunea bien, se cierra y se vende el acceso.
La cuenta de la IA en casa
burbubot desmonta el entusiasmo con la letra pequeña. El offloading a CPU, RAM y SSD funciona, pero el cuello de botella es el
ancho de banda de memoria: una GPU mueve cientos de GB/s, la RAM del PC decenas. Con las LUT en SSD cargando expertos de un MoE, los tokens por segundo caen a la mitad o menos.
Para trastear vale, para producción es un juguete, dice.
La cuenta total tampoco cuadra: cuatro tarjetas decentes hoy cuestan más que un utilitario km0, el consumo eléctrico se come el ahorro y lo que se libera en abierto llega capado y de un par de generaciones atrás.
Discrepante Libre resume la salida que le queda a más de uno: volver a programar de forma tradicional.