Calculadora de LLM local
El mejor LLM local para tu Mac mini
Del M1 al M6, y las versiones Pro: el modelo más potente que funciona con holgura en cada Mac mini y a qué velocidad escribe.
| Tu equipo | Memoria | Recomendados: funcionan con holgura | Escribe | Con un clic en Twoody |
|---|---|---|---|---|
M5 Pro — MacBook Pro, Mac mini |
24 GB | gpt-oss-20b | 68–97 tokens/s | Qwen3 14B |
| 48 GB | GLM-4.7-Flash | 92–132 tokens/s | Qwen3 14B | |
| 64 GB | GLM-4.7-Flash | 92–132 tokens/s | Qwen3 14B | |
M6 — Mac mini |
16 GB | Llama 3.1 8B | 17–31 tokens/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 30–54 tokens/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 36–64 tokens/s | Qwen3 14B | |
M4 Pro — MacBook Pro, Mac mini |
24 GB | gpt-oss-20b | 52–74 tokens/s | Qwen3 14B |
| 48 GB | GLM-4.7-Flash | 56–81 tokens/s | Qwen3 14B | |
| 64 GB | GLM-4.7-Flash | 56–81 tokens/s | Qwen3 14B | |
M4 — MacBook Air, MacBook Pro, Mac mini, iMac |
16 GB | Llama 3.1 8B | 15–22 tokens/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 25–36 tokens/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 32–46 tokens/s | Qwen3 14B | |
M2 Pro — MacBook Pro, Mac mini |
16 GB | Llama 3.1 8B | 24–35 tokens/s | Qwen3 8B |
| 32 GB | GLM-4.7-Flash | 45–65 tokens/s | Qwen3 14B | |
M2 — MacBook Air, MacBook Pro, Mac mini |
8 GB | Llama 3.2 3B | 32–45 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 13–19 tokens/s | Qwen3 8B | |
| 24 GB | gpt-oss-20b | 23–33 tokens/s | Qwen3 14B | |
M1 — MacBook Air, MacBook Pro, Mac mini, iMac |
8 GB | Llama 3.2 3B | 20–29 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 8,9–13 tokens/s | Qwen3 8B |
Estimaciones, no mediciones, calculadas a partir de los benchmarks públicos de llama.cpp. Cifras revisadas el 26 de septiembre de 2026.
El Mac mini es la forma más económica de ejecutar un LLM local en un Mac: un modelo de 8000 millones de parámetros con 16 GB, y una mezcla de expertos con 48 GB y un chip Pro.
Silencioso y siempre encendido, un Mac mini es además el tipo de equipo que las apps para teléfono en preparación están pensadas para usar a distancia.
Las versiones Pro leen su memoria más del doble de rápido que los chips básicos: modelos más grandes y respuestas más rápidas.
Preguntas sobre los LLM locales
¿Qué LLM elegir para un Mac mini M4 de 16 GB?
Qwen3 8B, Qwen3.5 9B o Llama 3.1 8B funcionan con holgura, a unos 15 a 21 tokens por segundo. Twoody instala Qwen3 8B con un clic.
¿Vale la pena un Mac mini M4 Pro para la IA local?
Con 48 o 64 GB, sí: ejecuta mezclas de expertos como Qwen3 30B-A3B o gpt-oss-20b a varias decenas de tokens por segundo.
¿Un Mac mini puede servir un LLM local a otros dispositivos?
Eso es lo que harán las apps para teléfono en preparación: usar el modelo de tu Mac desde un iPhone o un teléfono Android, con una conexión cifrada de extremo a extremo.
El mejor LLM local, por equipo
Prueba la IA local en tu Mac, gratis.
Versión 0.12.1 · macOS 13 o posterior · sin cuenta, sin suscripción. Descárgalo, instala un modelo con un clic y haz tu primera pregunta, incluso sin conexión.