Calculadora de LLM local
El mejor LLM local para tu MacBook Air
Del M1 al M5, con 8 a 32 GB: el modelo más potente que funciona con holgura en cada MacBook Air y a qué velocidad escribe.
| Tu equipo | Memoria | Recomendados: funcionan con holgura | Escribe | Con un clic en Twoody |
|---|---|---|---|---|
M5 — MacBook Air, MacBook Pro |
16 GB | Llama 3.1 8B | 20–28 tokens/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 32–47 tokens/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 41–59 tokens/s | Qwen3 14B | |
M4 — MacBook Air, MacBook Pro, Mac mini, iMac |
16 GB | Llama 3.1 8B | 15–22 tokens/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 25–36 tokens/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 32–46 tokens/s | Qwen3 14B | |
M3 — MacBook Air, MacBook Pro, iMac |
8 GB | Llama 3.2 3B | 31–45 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 13–19 tokens/s | Qwen3 8B | |
| 24 GB | gpt-oss-20b | 23–32 tokens/s | Qwen3 14B | |
M2 — MacBook Air, MacBook Pro, Mac mini |
8 GB | Llama 3.2 3B | 32–45 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 13–19 tokens/s | Qwen3 8B | |
| 24 GB | gpt-oss-20b | 23–33 tokens/s | Qwen3 14B | |
M1 — MacBook Air, MacBook Pro, Mac mini, iMac |
8 GB | Llama 3.2 3B | 20–29 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 8,9–13 tokens/s | Qwen3 8B |
Estimaciones, no mediciones, calculadas a partir de los benchmarks públicos de llama.cpp. Cifras revisadas el 26 de septiembre de 2026.
Un MacBook Air comparte su memoria entre el procesador y la GPU. Con 16 GB, un modelo de 8000 millones de parámetros deja espacio para tus otras apps; con 8 GB, quédate en unos 4000 millones.
La velocidad depende del ancho de banda de memoria del chip: cada generación escribe más rápido, y el M5 lee un documento varias veces más rápido que los chips anteriores.
Sin ventilador, un MacBook Air baja el ritmo tras unos minutos de trabajo continuo: no se nota en respuestas de longitud normal, pero sí en sesiones largas.
Preguntas sobre los LLM locales
¿Qué LLM elegir para un MacBook Air M4 de 16 GB?
Qwen3 8B o Qwen3.5 9B: funcionan con holgura y escriben unos 15 a 21 tokens por segundo. Twoody instala Qwen3 8B con un clic.
¿Un MacBook Air de 8 GB puede ejecutar un LLM local?
Sí, un modelo de unos 4000 millones de parámetros, como Qwen3 4B, que Twoody instala en estos Mac. Cierra las apps pesadas mientras lo usas.
¿Un MacBook Air se calienta demasiado con un LLM local?
Más que calentarse, baja el ritmo: sin ventilador, reduce su velocidad tras unos minutos escribiendo sin parar. En las preguntas del día a día no se nota.
El mejor LLM local, por equipo
Prueba la IA local en tu Mac, gratis.
Versión 0.12.1 · macOS 13 o posterior · sin cuenta, sin suscripción. Descárgalo, instala un modelo con un clic y haz tu primera pregunta, incluso sin conexión.