YouMind
Iniciar sesión

Cómo pasé de $200 al mes a $3: Una caja de Apple

@starmexxx
INGLÉS02 jun 2026
2.6M
470
91
31
1.9K

TL;DR

Aprende cómo los desarrolladores están utilizando Mac Mini M4 y Ollama para ejecutar potentes modelos de IA de forma local, ahorrando miles en tarifas de suscripción mientras mantienen la privacidad y la velocidad.

Me enteré de esto tarde. No cometas el mismo error.

Sigue y guarda en favoritos — soy starmex, rastreo jugadas de IA que la mayoría aún no ha descubierto. Esta es una locura. Te explicaré la factura, el hardware, los modelos y, al final, te daré el plan exacto que armé después de pasar un fin de semana configurando esto yo mismo.

Hace dos meses, un desarrollador publicó su factura de Claude Code en Reddit. $170 en 10 días. Estaba construyendo un SaaS, ejecutando flujos de trabajo agentivos, dejando que Claude Code hiciera el trabajo pesado. La calidad era mágica, dijo. La factura no.

Entonces alguien respondió: «Compré una Mac Mini M4. No le he pagado a Anthropic desde entonces».

Uber implementó Claude Code para 5000 ingenieros y vio cómo las facturas por persona subían a $500–$2000 al mes. Quemaron todo su presupuesto de IA para 2026 de $3400 millones en cuatro meses. Eso no es un caso extremo: eso es lo que realmente cuesta el uso serio de IA a escala.

Investigué. Las Apple Stores en todo Estados Unidos se estaban quedando sin Mac Minis, no por un lanzamiento de producto ni una campaña de marketing, sino porque los desarrolladores las compraban específicamente para ejecutar IA localmente. Una máquina, una compra, $3 al mes de electricidad, y nada de lo que hagas sale jamás de tu hardware.

1/

La factura que está llevando a la gente al hardware.

Claude Code Max: $200/mes. ChatGPT Pro: $200/mes. Gemini Advanced: $20/mes. Si eres un desarrollador que usa IA en serio, probablemente estés pagando al menos dos de estos.

text
1┌──────────────────────────┬───────────────┬──────────────┐
2│ Subscription │ Monthly cost │ Annual cost │
3├──────────────────────────┼───────────────┼──────────────┤
4│ Claude Code Max (20x) │ $200/month │ $2,400/year │
5│ ChatGPT Pro │ $200/month │ $2,400/year │
6│ Gemini Advanced │ $20/month │ $240/year │
7│ GitHub Copilot │ $19/month │ $228/year │
8│ Cursor Pro │ $20/month │ $240/year │
9├──────────────────────────┼───────────────┼──────────────┤
10│ Total heavy user │ $459/month │ $5,508/year │
11└──────────────────────────┴───────────────┴──────────────┘

2/

Qué es realmente la Mac Mini M4 en 2026.

Apple la posicionó como «la Mac más popular de la historia». Los desarrolladores la convirtieron en algo completamente distinto: un servidor privado de IA 24/7 que cabe debajo de tu escritorio y cuesta menos al mes que un café.

text
1┌─────────────────────────┬──────────────────┬────────────────────┐
2│ Spec │ Mac Mini M4 │ Mac Mini M4 Pro │
3├─────────────────────────┼──────────────────┼────────────────────┤
4│ Price │ $599 │ $1,399 │
5│ RAM options │ 16GB / 32GB │ 24GB / 48GB / 64GB │
6│ Power consumption │ 10-20W │ 20-30W │
7│ Electricity 24/7 │ ~$2-3/month │ ~$3-5/month │
8│ Best model size │ up to 14B │ up to 70B │
9│ Noise │ silent │ silent │
10│ Size │ 5 inch square │ 5 inch square │
11└─────────────────────────┴──────────────────┴────────────────────┘

¿Por qué Mac Mini específicamente y no una PC con Windows o una Jetson? Tres razones importantes para IA:

Arquitectura de memoria unificada: en una PC normal, los datos se copian constantemente entre la RAM del sistema y la VRAM de la GPU, lo que mata la velocidad de inferencia. En Apple Silicon, la CPU y la GPU comparten un único conjunto de memoria. El modelo se queda ahí una vez y ambos leen directamente. Por eso una Mac Mini de $599 ejecuta IA más rápido que una máquina Windows de $1500 con GPU discreta.

Ancho de banda de memoria: el chip M4 tiene 120 GB/s de ancho de banda. Eso es lo que realmente determina la velocidad de generación de tokens, no la generación del chip. Más ancho de banda significa respuestas más rápidas.

Eficiencia siempre encendida: 10–20 W funcionando 24/7. Una máquina Windows de IA consume 300–500 W haciendo el mismo trabajo. La Mac Mini cuesta $2–3/mes en electricidad. La PC con Windows cuesta $30–50/mes solo por estar encendida.

starmex - inline image

3/

Qué funciona realmente en ella. Desglose honesto.

Aquí es donde la mayoría de los artículos te mienten. No todo funciona igual de bien. Esta es la imagen real:

text
1┌──────────────────┬────────┬────────────┬───────────────────────────┐
2│ Model │ Size │ RAM needed │ Best for │
3├──────────────────┼────────┼────────────┼───────────────────────────┤
4│ Gemma 4 4B │ 4B │ 16GB │ Quick tasks, email, drafts│
5│ Qwen 3.6 8B │ 8B │ 16GB │ Coding, writing │
6│ Mistral 7B │ 7B │ 16GB │ General use │
7│ Qwen 3.6 14B │ 14B │ 32GB │ Serious coding, analysis │
8│ DeepSeek R1 14B │ 14B │ 32GB │ Reasoning, math, logic │
9│ Llama 3.3 70B │ 70B │ 64GB │ Frontier-level tasks │
10└──────────────────┴────────┴────────────┴───────────────────────────┘

Modelo base de $599 (16 GB RAM): ejecuta cómodamente todo hasta 8B parámetros. Suficiente para el 70% de las tareas diarias: redactar, resumir, escribir scripts, preguntas y respuestas. No reemplaza a Claude Opus en flujos agentivos complejos.

$799 con 32 GB RAM: este es el punto óptimo. Ejecuta modelos de 14B a velocidad utilizable. Qwen 3.6 14B y DeepSeek R1 14B en este nivel manejan tareas reales de codificación. XDA Developers lo probó en abril de 2026 y concluyó: «la productividad no bajó ni un poco» al reemplazar Claude Pro.

$1399 M4 Pro con 48 GB: ejecuta modelos de 70B. Lo más cercano a nivel GPT-4 localmente. Ahí es donde deberían mirar los usuarios intensivos de Claude Code.

starmex - inline image

4/

La configuración. Tres comandos.

Igual que Jetson: Ollama se encarga de todo. Instalación de una línea, descarga un modelo, ejecútalo. Claude Code se conecta automáticamente.

bash
1# Paso 1 - Instalar Ollama (2 minutos)
2curl -fsSL https://ollama.com/install.sh | sh
3
4# Paso 2 - Descargar un modelo
5ollama pull qwen3.6:14b
6
7# Paso 3 - Conectar Claude Code al modelo local
8ANTHROPIC_BASE_URL=http://localhost:11434/v1 claude

Esa última línea es de la que nadie habla. Desde enero de 2026, Ollama soporta el formato de la API de Anthropic Messages. Claude Code —la interfaz que ya conoces— se conecta directamente a tu modelo local con una variable de entorno. Mismos comandos. Mismo flujo de trabajo. Costo de API: cero.

Para una interfaz de navegador idéntica a ChatGPT:

bash
1docker run -d -p 3000:8080 \
2 --add-host=host.docker.internal:host-gateway \
3 -v open-webui:/app/backend/data \
4 ghcr.io/open-webui/open-webui:main

Abre localhost:3000 y tienes un ChatGPT privado funcionando completamente en tu propio hardware, sin suscripción y sin que ningún dato salga jamás de tu máquina.

starmex - inline image

5/

Las cuentas honestas. Quién debería comprarla realmente.

El cálculo de costos solo funciona en situaciones específicas. Aquí está el desglose real:

text
1┌──────────────────────────────────┬───────────────────────────────┐
2│ Your situation │ Verdict │
3├──────────────────────────────────┼───────────────────────────────┤
4│ Paying $200+/month on AI APIs │ Buy it. Pays off in 3 months │
5│ Privacy-critical work │ Buy it. Data never leaves │
6│ Heavy Claude Code user ($6+/day) │ Buy it. ROI in 30 days │
7│ Casual ChatGPT user ($20/month) │ Skip. Math doesn't work │
8│ Need frontier model (Opus, GPT5) │ Keep subscription + use local │
9│ │ for 80% of tasks │
10└──────────────────────────────────┴───────────────────────────────┘

La configuración más inteligente en 2026 no es «solo local» ni «solo nube» — es híbrida. La Mac Mini local maneja el 80% del trabajo diario de forma gratuita. Mantienes una suscripción de $20/mes para el difícil 20% que necesita razonamiento de modelos frontera. Costo mensual total: $23 en lugar de $459.

6/

Qué está ejecutando la gente 24/7.

Cuando la IA cuesta $0 por solicitud, empiezas a automatizar cosas por las que nunca pagarías por token.

Flujos de codificación

Asistente de codificación privado donde ningún código propietario sale jamás de la máquina. Preguntas y respuestas sobre documentos en bases de código sensibles. Revisión automatizada de código que se ejecuta en cada commit. Pruebas locales de API antes de enviar cualquier cosa a producción.

Contenido y redacción

Asistente de redacción de correos electrónicos ejecutándose localmente. Resúmenes matutinos compilados desde fuentes RSS. Resumen de documentos extensos y PDF. Sistema RAG sobre tu propia base de conocimiento.

Trabajo con privacidad crítica

Análisis de documentos legales. Resumen de registros médicos. Procesamiento de datos financieros. Datos de clientes que nunca pegarías en ChatGPT.

7/

La pila completa.

text
1HARDWARE: Mac Mini M4 $599 one-time
2 apple.com/mac-mini
3
4RUNTIME: Ollama v0.14.0+ — free, open source
5 ollama.com
6
7INTERFACE: Open WebUI — private ChatGPT in browser
8 github.com/open-webui/open-webui
9
10CODING AGENT: Claude Code pointed at local Ollama
11 ANTHROPIC_BASE_URL=http://localhost:11434/v1
12
13MODELS: Qwen 3.6 14B for coding
14 DeepSeek R1 14B for reasoning
15 Gemma 4 4B for quick tasks
16 All free on Ollama model library
17
18POWER: ~$3/month electricity running 24/7
19 Silent. Fits in a backpack.
20
21PRIVACY: Nothing leaves your network. Ever.
22 No terms of service on your own hardware.

La ventana.

Las Apple Stores se quedaron sin Mac Minis. No por un lanzamiento de producto, no por una campaña de marketing — sino porque los desarrolladores se dieron cuenta de que $599 una vez es mejor que $200/mes para siempre. La escasez de Mac Mini en 2026 es la reseña de producto más honesta que cualquier máquina haya recibido.

Claude Code, ChatGPT Pro, Gemini Advanced — son excelentes productos. También son $5508 al año si los usas en serio. La Mac Mini no los reemplaza por completo. Reemplaza el 80% de lo que haces con ellos, a $3/mes, funcionando en silencio bajo tu escritorio mientras duermes.

El otro 20% — mantén tu suscripción de $20/mes para lo difícil. Costo total: $23/mes en lugar de $459. Eso son $5232 de vuelta en tu bolsillo cada año.

// La ventana está abierta

Este hilo es solo la punta — escribí el desglose completo con cada comando, cada modelo que vale la pena ejecutar y los 10 prompts que realmente hacen que un modelo de 14B se sienta como Claude en tu máquina.

Todo está aquí → starmexxx.gumroad.com/l/mac-mini-ai-setup

Cuesta menos que un solo mes de cualquier suscripción que cancelarías.

Sigue a @starmexxx — sigo encontrando esto antes de que se cierren //

Guardar con un clic

Lee artículos virales en profundidad con IA en YouMind

Guarda la fuente, haz preguntas concretas, resume el argumento y convierte un artículo viral en notas reutilizables en un único espacio de trabajo con IA.

Explora YouMind
Para creadores

Convierte tu Markdown en un artículo de 𝕏 impecable

Cuando publicas tus propios textos largos, dar formato en 𝕏 a imágenes, tablas y bloques de código es un fastidio. YouMind convierte un borrador completo en Markdown en un artículo de 𝕏 impecable y listo para publicar.

Prueba Markdown a 𝕏

Más patrones por descifrar

Artículos virales recientes

Explorar más artículos virales