Calculadora de LLM local
Un LLM local en tu Mac con Intel
Twoody funciona en los Mac con Intel y macOS 13 o posterior. El modelo se ejecuta en el procesador: los modelos pequeños funcionan, pero despacio.
| Tu equipo | Memoria | Recomendados: funcionan con holgura | Escribe | Con un clic en Twoody |
|---|---|---|---|---|
MacBook Air, MacBook Pro 13″ Intel (2018–2020) |
8 GB | Qwen3 0.6B | 22–65 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 3,4–6,1 tokens/s | Qwen3 8B | |
| 32 GB | GLM-4.7-Flash | 7,9–14 tokens/s | Qwen3 14B | |
MacBook Pro 15″, 16″ Intel (2018–2019) |
16 GB | Llama 3.1 8B | 3–5,4 tokens/s | Qwen3 8B |
| 32 GB | GLM-4.7-Flash | 7,1–13 tokens/s | Qwen3 14B | |
| 64 GB | Qwen3-Next 80B-A3B | 6–11 tokens/s | Qwen3 14B | |
iMac, Mac mini Intel (2017–2020) |
8 GB | Qwen3 0.6B | 21–62 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 3,2–5,7 tokens/s | Qwen3 8B | |
| 32 GB | GLM-4.7-Flash | 7,5–13 tokens/s | Qwen3 14B | |
| 64 GB | Qwen3-Next 80B-A3B | 6,4–11 tokens/s | Qwen3 14B | |
iMac Pro, Mac Pro (2017–2019) |
32 GB | GLM-4.7-Flash | 17–30 tokens/s | Qwen3 14B |
| 64 GB | Qwen3-Next 80B-A3B | 14–25 tokens/s | Qwen3 14B | |
| 128 GB | Qwen3-Next 80B-A3B | 14–25 tokens/s | Qwen3 14B |
Estimaciones, no mediciones, calculadas a partir de los benchmarks públicos de llama.cpp. Cifras revisadas el 26 de septiembre de 2026.
En un Mac con Intel, llama.cpp usa el procesador, no la GPU: un modelo de unos 4000 millones de parámetros escribe unas pocas palabras por segundo, suficiente para respuestas cortas.
Twoody instala el Qwen3 adecuado para la memoria; en estos Mac, el 4B es el que responde más rápido.
LM Studio necesita un Mac con Apple Silicon y macOS 14, y Ollama, macOS 14: en un Mac con Intel o con macOS 13, Twoody instala y ejecuta un modelo con un clic.
Preguntas sobre los LLM locales
¿Un LLM local funciona en un Mac con Intel?
Sí, en el procesador: un modelo de 4000 millones de parámetros escribe unos pocos tokens por segundo, y leer un documento largo lleva varios minutos.
¿Qué app de IA local funciona en macOS 13?
Twoody funciona en macOS 13 (Ventura) y posteriores, con Apple Silicon y con Intel; instala un modelo con un clic.
¿Qué modelo elegir para un Mac con Intel?
Los más pequeños que siguen siendo útiles: Qwen3 4B o Qwen3.5 4B. Los modelos más grandes caben en la memoria, pero escriben demasiado despacio para usarlos con comodidad.
El mejor LLM local, por equipo
Prueba la IA local en tu Mac, gratis.
Versión 0.12.1 · macOS 13 o posterior · sin cuenta, sin suscripción. Descárgalo, instala un modelo con un clic y haz tu primera pregunta, incluso sin conexión.