Opciones para montar un IA workstation y valoaciones.

IA workstation local con tarjeta gráfica de gama alta y memoria rápida para inferencia de modelos de lenguaje

IA local: 7.000€ el Mac Studio o 3.000€ el PC lento​

Montar una estación de trabajo para inteligencia artificial local tiene un precio de entrada que quita las ganas. Según las cifras que se manejan en el debate, el Mac Studio M5 Ultra ronda los 7.000 euros y ofrece un ancho de banda de 1 TB por segundo. Un equipo PC de los que se anuncian como «IA workstation» baja a unos 3.000 euros, pero su memoria mueve datos a 250 GB/s. La diferencia no es cosmética: es la que decide si la máquina responde en segundos o en minutos.

El cuello de botella no está en el procesador. Está en la memoria. El silicio se queda esperando a que le lleguen los datos, y esa espera la marca el ancho de banda, que depende del tamaño del bus y de la velocidad de los módulos. Traducido a la práctica, y según el ejemplo que se da en el propio hilo: una IA de 27.000 millones de parámetros sobre una gráfica de 900 GB/s genera 40 tokens por segundo; el mismo modelo en un PC de 90 GB/s se queda en 4 tokens por segundo. Diez veces menos, y la sensación al usarlo pasa de un chat fluido a una máquina de escribir con resaca.

¿Se puede amortizar una IA local frente a Claude o ChatGPT?​

La respuesta corta, para quien ha hecho las cuentas, es que casi nunca. Hay quien sostiene que, mientras las suscripciones a Claude o ChatGPT mantengan sus precios, ninguna inversión de ese calibre en hardware se rentabiliza en la vida, y que aun así los modelos punteros en la nube siguen siendo mejores que lo que cabe en casa.

Frente a eso pesa un argumento que no es económico, sino de control: privacidad, propiedad de los datos y no depender de que un proveedor cambie condiciones, precios o disponibilidad. Tener tu propio modelo significa que nadie te corta el grifo. A un precio razonable, claro. Y ahí está el problema entero.

El muro del ancho de banda: por qué el Mac juega en otra liga​

El Mac Studio M5 Ultra y los PC de memoria rápida compiten en tablas distintas. Un PC de gama alta puede alcanzar los 250 GB/s; el Mac cuadruplica esa cifra. La gráfica RTX 5090, por su parte, se ha visto estos días en el entorno de los 6.000 euros, lo que dispara el presupuesto.

La comparativa de anchos de banda deja el mapa claro:
  • Mac Studio M5 Ultra: 1 TB/s (1.000 GB/s)
  • Gráfica de gama alta: 900 GB/s
  • PC IA: 250 GB/s
  • PC con memoria a 90 GB/s
No se trata de tener más gigabytes, sino de moverlos más rápido. Un modelo pequeño puede rendir de sobra si la memoria lo alimenta a tiempo.

Los modelos pequeños y la inferencia en 16 GB de VRAM​

La otra mitad del debate no va de hierro, sino de software. Para privacidad hay quien tira de modelos abiertos cuantizados —variantes GGUF de un Qwen de 27.000 millones en formato IQ3_S— que caben en 16 GB de VRAM y van sorprendentemente bien. No igualan a los tope de gama cerrados, pero ofrecen en local lo que el año pasado era punta de lanza.

Los modelos abiertos actuales manejan contextos de 200.000 tokens y destacan en memoria, pero quienes defienden esta vía sostienen que el salto de rendimiento vendrá del razonamiento: modelos que revisan sus propias respuestas y reorganizan el trabajo en varias pasadas. Con eso, uno pequeño podría resolver problemas que hoy pide uno enorme.

El riesgo que nadie cubre: que corten el grifo​

Hay un escenario que frena a más de uno antes de firmar el pedido: gastarte una pasta y que en unos meses los creadores de modelos abiertos cambien de política y dejen de publicar pesos. El entrenamiento exige miles de GPUs y no se hace en comunidad, así que un particular queda a merced de lo que decidan esas empresas.

Quien no quiere arriesgar tanto tira de parches baratos: un Mac mini comprado antes de la subida de precios hace un papel decente para trastear. Para todo lo demás, los DGX Spark de Nvidia son los equipos que, según se comenta en el hilo, está comprando la gente para IA local.

La velocidad de tokens por segundo deja el listón donde está: con hablar de tokens por segundo en vez de segundos por token, ya se pueden hacer cosas.
💬 LO QUE DICEN LOS FOREROS
«Para IA local seria la gente se están pillando los DGX Spark de Nvidia, pero como te dicen arriba, no lo vas a rentabilizar en la vida si las suscripciones de Claude/ChatGPT mantienen precios.»
— chiquetete · hardware IA local
«Una IA de 27B en una grafica de 900GB/s puede ir a 40 tokens por segundo. Entonces en un PC de 90GB/s iria a 4 t/s.»
— vallamete · velocidad tokens por segundo
«te puedes gastar una pasta en un servidor de IA local y que en unos meses los chinos corten el grifo de los modelos abiertos, con lo que te quedarías con modelos atrasados»
— calopez · riesgo modelos abiertos
📊 OPINIONES
Peso aproximado de cada postura en el debate. No es una encuesta.
No sale a cuenta, mejor suscripción40%
Privacidad y control no tienen precio30%
PC de gama media, aceptable para trastear20%
Miedo a que corten modelos abiertos10%
📈 EN CIFRASAncho de banda de memoria por equipo
GPU de gama alta: 900 GB/sGPU de gama alta900 GB/sPC IA convencional: 250 GB/sPC IA convencional250 GB/sPC básico: 90 GB/sPC básico90 GB/s
Cifras tal como se citan en el hilo; no son una fuente oficial.
Ver los datos
GPU de gama alta900 GB/s
PC IA convencional250 GB/s
PC básico90 GB/s
📌 DATOS
Mac Studio M5 Ultra con 1 TB/s de ancho de banda por unos 7.000 euros
PC IA por unos 3.000 euros con ancho de banda de 250 GB/s
RTX 5090 vista a 6.000 euros
Modelos cuantizados de 27B en formato IQ3_S caben en 16 GB de VRAM
Modelos abiertos con contexto de 200.000 tokens
📅 EVOLUCIÓN
Actualidad Se abre el planteamiento sobre qué opciones hay para montar una estación de IA local y a qué precio
Actualidad Se fija el techo del Mac Studio M5 Ultra en torno a 7.000 euros y 1 TB/s de ancho de banda
Actualidad Se sitúa el PC de IA en unos 3.000 euros con 250 GB/s y la RTX 5090 en 6.000 euros
Actualidad Aparece el argumento de la no amortización frente a las suscripciones y la duda de que los modelos abiertos se cierren
💬 POR QUÉ PARTICIPAR
✓La comparativa de anchos de banda que explica por qué el Mac Studio duplica al PC de gama alta y multiplica al de 90 GB/s
✓El cálculo de rentabilidad frente a las suscripciones de Claude o ChatGPT, que da la vuelta a toda la decisión de compra
✓La lista de hardware alternativo: DGX Spark de Nvidia, Mac mini de segunda mano y modelos cuantizados en 16 GB
Este es un resumen del hilo. La discusión completa incluye 16 respuestas con datos, fuentes y análisis que solo están disponibles para usuarios registrados. Crea tu cuenta en 30 segundos para acceder al debate completo y participar.
🔓 Aquí dentro está el debate, no el resumen
Los datos, las fuentes y las discusiones de las 16 respuestas, tal y como las escribieron los foreros.
Ver el debate completo →
Gratis · Sin tarjeta
Resumen elaborado con IA a partir del debate de la comunidad — 16 respuestas analizadas. Última actualización: .

Estadísticas del foro

Temas
2.053.365
Mensajes
58.273.033
Miembros
190.918
Último miembro
noreply323

El blog de burbuja.info

Volver