Guía de IA local en Mac Mini: Lo que realmente obtienes por $799 (y lo que no)

@0xGrimmer_
INGLÉShace 4 días · 17 jul 2026
859K
76
2
1
299

TL;DR

Esta guía analiza el Mac Mini M4 y M4 Pro para la inferencia de IA local, destacando el papel fundamental de la memoria unificada y el ancho de banda para ejecutar modelos de lenguaje grandes de manera eficiente.

En algún lugar, un desarrollador paga 200 dólares al mes por IA y tiene un Mac mini a tres pies de distancia que podría hacer la mayor parte de eso por el precio de la electricidad.

El Mac mini es el dispositivo al que la gente recurre primero cuando quiere ejecutar IA en casa, y por buenas razones. Es silencioso, consume poca energía y lo deja todo en tu propia máquina. Pero hay dos números que deciden si es brillante o una pérdida de dinero para ti, y casi nadie los explica antes de comprar.

Esta es la versión honesta. Para qué es excelente el Mac mini, dónde se queda corto silenciosamente, qué configuración deberías comprar realmente, y las cuentas reales en 2026.

Por qué el Mac mini, específicamente

La palabra mágica es memoria unificada.

En una PC normal, la tarjeta gráfica tiene su propia VRAM, y esa VRAM es un muro infranqueable. Si un modelo no cabe, no se carga. Apple construye un único grupo de memoria que comparten la CPU y la GPU, por lo que el Mac mini puede contener y ejecutar modelos que una caja Windows con especificaciones similares y VRAM separada no puede.

Añádele tres cosas más. Funciona casi en silencio, consume entre 10 y 30 vatios bajo carga en lugar de cientos, y es lo suficientemente pequeño como para dejarlo encendido las 24 horas como el servidor silencioso detrás de tus automatizaciones. Esa combinación es la razón por la que el Mac mini se convirtió en la caja de IA doméstica por defecto, no la potencia bruta.

Grimmer - inline image

Los dos números que lo deciden todo

Antes de mirar un solo precio, entiende las dos especificaciones que realmente importan para la IA local.

La memoria es capacidad. Decide qué modelos pueden cargarse en absoluto. A grandes rasgos: 16 GB ejecutan cómodamente un modelo de 7B, 24 GB se estiran hasta un 14B cuantizado, y necesitas 48 GB antes de que un modelo de 30B sea realmente cómodo. Compra para el tamaño de modelo que quieras ejecutar, porque esto es un muro, no un regulador.

El ancho de banda es velocidad. Decide qué tan rápido salen las palabras una vez que el modelo está cargado. Esta es la parte que el marketing de Apple nunca pone en la caja, y es donde los dos chips se separan drásticamente:

text
1Apple M4 120 GB/s
2Apple M4 Pro 273 GB/s

Esa brecha no es cosmética. Es por lo que el M4 base se siente instantáneo en un modelo de 7B y empieza a arrastrarse en algo grande, mientras que el M4 Pro sigue siendo utilizable en modelos de 30B. La capacidad permite que el modelo se cargue. El ancho de banda determina si disfrutas usándolo.

Grimmer - inline image

Qué configuración comprar realmente

Tres niveles honestos, con velocidades medidas reales.

El M4 base (16 a 24 GB, 120 GB/s). Esta es la máquina del "mi asistente diario vive aquí". Con 16 GB ejecuta Llama 3.2 3B y Qwen2.5 7B a unos 25 tokens por segundo, lo que se siente instantáneo, y un modelo de 14B a unos 10 tokens por segundo, que es utilizable pero ya no es rápido. Perfecto para escribir, redactar, resumir, clasificar y preguntas y respuestas sobre tus propias notas. No disfrutará un modelo de 30B.

El M4 Pro (48 GB, 273 GB/s). Este es el mejor Mac mini para IA local en 2026, punto final. El ancho de banda y la memoria adicionales le permiten ejecutar un modelo de clase 30B a aproximadamente 40 tokens por segundo en uso real de chat, lo que es genuinamente cómodo. Si quieres que el mini sea un servidor de inferencia real y no solo un chatbot, este es el indicado.

Salta el intermedio si puedes. Un M4 base con la máxima RAM pero atascado a 120 GB/s cargará modelos más grandes y luego los ejecutará lentamente. Si necesitas modelos grandes, el ancho de banda del Pro importa más que unos pocos gigabytes adicionales en el chip base.

Las cuentas honestas en 2026

Aquí es donde la historia cambió este año, y la versión honesta importa.

text
1Mac mini M4 (16GB / 512GB) desde $799
2 Actualización a 24GB de memoria ~ +$200
3Mac mini M4 Pro (24GB) desde $1,599
4 Configuración de 48GB más alto, y con suministro limitado
5Electricidad 24/7 ~$3 a $8 / mes

El precio base saltó de $599 a $799 este año, y Apple limitó silenciosamente el M4 a 24 GB y el M4 Pro a 48 GB, porque una escasez global de memoria impulsada por la construcción de centros de datos de IA ha hecho que la RAM sea escasa y cara. Para una máquina donde la memoria es el punto central, ese es el asterisco honesto: ponle precio a la configuración que realmente necesitas, y sabe que el número está subiendo, no bajando.

Frente a un conjunto de suscripciones, la recuperación de la inversión es real pero no instantánea. Un mini de $799 frente a un hábito de IA de $100 al mes se amortiza en unos ocho meses, luego son unos pocos dólares de electricidad para siempre. Frente a un hábito ligero de ChatGPT Plus de $20, el mini nunca se paga solo en efectivo, y no deberías fingir lo contrario. La caja vale la pena cuando realmente usas IA a diario, no ocasionalmente.

La configuración lleva una tarde

El proceso es el mismo para todas las configuraciones.

Instala Ollama, la herramienta que convierte cualquier modelo en una API local que habla el lenguaje de OpenAI:

bash
1curl -fsSL https://ollama.com/install.sh | sh

Descarga un modelo adaptado a tu memoria:

bash
1# M4 base, 16 a 24 GB:
2ollama pull llama3.2
3ollama pull qwen2.5:7b
4
5# M4 Pro, 48 GB:
6ollama pull qwen2.5:32b

Luego apunta cualquier herramienta que ya uses al endpoint local cambiando una línea:

bash
1client = OpenAI(base_url="http://localhost:11434/v1", api_key="ollama")

Añade Open WebUI en Docker si quieres un chat en navegador que se vea como ChatGPT, y tendrás un asistente privado funcionando completamente en tu escritorio.

Qué sale mal realmente

La memoria es el techo, y es cara ahora mismo. Cada historia de "no funciona" es un modelo que no cabía. Compra la RAM por adelantado, porque no puedes añadirla después, y la escasez ha hecho que esas actualizaciones sean más caras que hace un año.

El M4 base tiene limitaciones de ancho de banda. A 120 GB/s es una maravilla en modelos de 7B y lento en los grandes. No compres el mini más barato esperando velocidades de 30B. Para eso está el Pro.

El trabajo de frontera aún pertenece a la nube. El razonamiento más difícil y la codificación de vanguardia siguen favoreciendo a los mejores modelos alojados. El Mac mini es el caballo de batalla confiable, privado y siempre encendido para el 80% del día a día, no un reemplazo para todo. Mantén una suscripción en la nube para el 20% difícil y ejecuta el resto en casa.

No es portátil. Es un escritorio atado a la pared. Si necesitas IA en movimiento, esta es la herramienta equivocada.

Para quién es, y para quién no es

Compra un Mac mini si usas IA a diario, quieres una máquina silenciosa que funcione todo el día, te importa mantener tus datos en tu propio hardware, y estás contento con un terminal para la configuración. Compra el M4 Pro si quieres ejecutar modelos de 30B a velocidad real.

Saltátelo si toda tu vida de IA cabe en una suscripción de $20, solo necesitas un chatbot de vez en cuando, o necesitas algo que puedas llevar contigo.

Dos cosas que hacer ahora

Pruébalo gratis primero. Instala Ollama en el Mac que ya tienes y ejecuta un modelo de 7B este fin de semana. Cualquier máquina Apple Silicon con 16 GB lo hace. Prueba el flujo de trabajo antes de gastar un centavo.

Luego compra para el modelo, no para la etiqueta de precio. Decide el modelo más grande que realmente quieras ejecutar, luego elige la configuración cuya memoria lo contenga y cuyo ancho de banda lo ejecute. Para la mayoría de las personas, eso es un M4 base de 24 GB. Para cualquiera que hable en serio sobre modelos de 30B, es el M4 Pro con 48 GB.

La estrategia nunca fue la parte difícil. Es una caja silenciosa, un cambio de una línea, y la decisión de dejar de alimentar una suscripción por trabajo que una máquina en tu escritorio ya puede hacer.

Sígueme para más análisis como este.

*

*Analizo herramientas de IA y el dinero que se gana con ellas regularmente como esta. Sígueme para la próxima, y únete a mi Telegram: https://t.me/+3XrP38Cv9fk2YTM6

Recrear en YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Para creadores

Convierte tu Markdown en un artículo de 𝕏 impecable

Cuando publicas tus propios textos largos, dar formato en 𝕏 a imágenes, tablas y bloques de código es un fastidio. YouMind convierte un borrador completo en Markdown en un artículo de 𝕏 impecable y listo para publicar.

Prueba Markdown a 𝕏

Más patrones por descifrar

Artículos virales recientes

Explorar más artículos virales