Twoody

Calculadora de LLM local

El mejor LLM local para tu Mac mini

Del M1 al M6, y las versiones Pro: el modelo más potente que funciona con holgura en cada Mac mini y a qué velocidad escribe.

Tu equipo Memoria Recomendados: funcionan con holgura Escribe Con un clic en Twoody

M5 Pro — MacBook Pro, Mac mini

24 GB gpt-oss-20b 68–97 tokens/s Qwen3 14B
48 GB GLM-4.7-Flash 92–132 tokens/s Qwen3 14B
64 GB GLM-4.7-Flash 92–132 tokens/s Qwen3 14B

M6 — Mac mini

16 GB Llama 3.1 8B 17–31 tokens/s Qwen3 8B
24 GB gpt-oss-20b 30–54 tokens/s Qwen3 14B
32 GB GLM-4.7-Flash 36–64 tokens/s Qwen3 14B

M4 Pro — MacBook Pro, Mac mini

24 GB gpt-oss-20b 52–74 tokens/s Qwen3 14B
48 GB GLM-4.7-Flash 56–81 tokens/s Qwen3 14B
64 GB GLM-4.7-Flash 56–81 tokens/s Qwen3 14B

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 GB Llama 3.1 8B 15–22 tokens/s Qwen3 8B
24 GB gpt-oss-20b 25–36 tokens/s Qwen3 14B
32 GB GLM-4.7-Flash 32–46 tokens/s Qwen3 14B

M2 Pro — MacBook Pro, Mac mini

16 GB Llama 3.1 8B 24–35 tokens/s Qwen3 8B
32 GB GLM-4.7-Flash 45–65 tokens/s Qwen3 14B

M2 — MacBook Air, MacBook Pro, Mac mini

8 GB Llama 3.2 3B 32–45 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 GB gpt-oss-20b 23–33 tokens/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 GB Llama 3.2 3B 20–29 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 8,9–13 tokens/s Qwen3 8B

Estimaciones, no mediciones, calculadas a partir de los benchmarks públicos de llama.cpp. Cifras revisadas el 26 de septiembre de 2026.

El Mac mini es la forma más económica de ejecutar un LLM local en un Mac: un modelo de 8000 millones de parámetros con 16 GB, y una mezcla de expertos con 48 GB y un chip Pro.

Silencioso y siempre encendido, un Mac mini es además el tipo de equipo que las apps para teléfono en preparación están pensadas para usar a distancia.

Las versiones Pro leen su memoria más del doble de rápido que los chips básicos: modelos más grandes y respuestas más rápidas.

Preguntas sobre los LLM locales

¿Qué LLM elegir para un Mac mini M4 de 16 GB?

Qwen3 8B, Qwen3.5 9B o Llama 3.1 8B funcionan con holgura, a unos 15 a 21 tokens por segundo. Twoody instala Qwen3 8B con un clic.

¿Vale la pena un Mac mini M4 Pro para la IA local?

Con 48 o 64 GB, sí: ejecuta mezclas de expertos como Qwen3 30B-A3B o gpt-oss-20b a varias decenas de tokens por segundo.

¿Un Mac mini puede servir un LLM local a otros dispositivos?

Eso es lo que harán las apps para teléfono en preparación: usar el modelo de tu Mac desde un iPhone o un teléfono Android, con una conexión cifrada de extremo a extremo.

Prueba la IA local en tu Mac, gratis.

Versión 0.12.1 · macOS 13 o posterior · sin cuenta, sin suscripción. Descárgalo, instala un modelo con un clic y haz tu primera pregunta, incluso sin conexión.