Twoody

Calculadora de LLM local

El mejor LLM local para tu MacBook Air

Del M1 al M5, con 8 a 32 GB: el modelo más potente que funciona con holgura en cada MacBook Air y a qué velocidad escribe.

Tu equipo Memoria Recomendados: funcionan con holgura Escribe Con un clic en Twoody

M5 — MacBook Air, MacBook Pro

16 GB Llama 3.1 8B 20–28 tokens/s Qwen3 8B
24 GB gpt-oss-20b 32–47 tokens/s Qwen3 14B
32 GB GLM-4.7-Flash 41–59 tokens/s Qwen3 14B

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 GB Llama 3.1 8B 15–22 tokens/s Qwen3 8B
24 GB gpt-oss-20b 25–36 tokens/s Qwen3 14B
32 GB GLM-4.7-Flash 32–46 tokens/s Qwen3 14B

M3 — MacBook Air, MacBook Pro, iMac

8 GB Llama 3.2 3B 31–45 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 GB gpt-oss-20b 23–32 tokens/s Qwen3 14B

M2 — MacBook Air, MacBook Pro, Mac mini

8 GB Llama 3.2 3B 32–45 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 GB gpt-oss-20b 23–33 tokens/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 GB Llama 3.2 3B 20–29 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 8,9–13 tokens/s Qwen3 8B

Estimaciones, no mediciones, calculadas a partir de los benchmarks públicos de llama.cpp. Cifras revisadas el 26 de septiembre de 2026.

Un MacBook Air comparte su memoria entre el procesador y la GPU. Con 16 GB, un modelo de 8000 millones de parámetros deja espacio para tus otras apps; con 8 GB, quédate en unos 4000 millones.

La velocidad depende del ancho de banda de memoria del chip: cada generación escribe más rápido, y el M5 lee un documento varias veces más rápido que los chips anteriores.

Sin ventilador, un MacBook Air baja el ritmo tras unos minutos de trabajo continuo: no se nota en respuestas de longitud normal, pero sí en sesiones largas.

Preguntas sobre los LLM locales

¿Qué LLM elegir para un MacBook Air M4 de 16 GB?

Qwen3 8B o Qwen3.5 9B: funcionan con holgura y escriben unos 15 a 21 tokens por segundo. Twoody instala Qwen3 8B con un clic.

¿Un MacBook Air de 8 GB puede ejecutar un LLM local?

Sí, un modelo de unos 4000 millones de parámetros, como Qwen3 4B, que Twoody instala en estos Mac. Cierra las apps pesadas mientras lo usas.

¿Un MacBook Air se calienta demasiado con un LLM local?

Más que calentarse, baja el ritmo: sin ventilador, reduce su velocidad tras unos minutos escribiendo sin parar. En las preguntas del día a día no se nota.

Prueba la IA local en tu Mac, gratis.

Versión 0.12.1 · macOS 13 o posterior · sin cuenta, sin suscripción. Descárgalo, instala un modelo con un clic y haz tu primera pregunta, incluso sin conexión.