Twoody

Calculadora de LLM local

O melhor LLM local para o seu MacBook Air

Do M1 ao M5, com 8 a 32 GB: o modelo mais forte que roda com folga em cada MacBook Air, e com que velocidade ele escreve.

Seu computador Memória Recomendado — roda com folga Escreve Um clique no Twoody

M5 — MacBook Air, MacBook Pro

16 GB Llama 3.1 8B 20–28 tokens/s Qwen3 8B
24 GB gpt-oss-20b 32–47 tokens/s Qwen3 14B
32 GB GLM-4.7-Flash 41–59 tokens/s Qwen3 14B

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 GB Llama 3.1 8B 15–22 tokens/s Qwen3 8B
24 GB gpt-oss-20b 25–36 tokens/s Qwen3 14B
32 GB GLM-4.7-Flash 32–46 tokens/s Qwen3 14B

M3 — MacBook Air, MacBook Pro, iMac

8 GB Llama 3.2 3B 31–45 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 GB gpt-oss-20b 23–32 tokens/s Qwen3 14B

M2 — MacBook Air, MacBook Pro, Mac mini

8 GB Llama 3.2 3B 32–45 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 GB gpt-oss-20b 23–33 tokens/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 GB Llama 3.2 3B 20–29 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 8,9–13 tokens/s Qwen3 8B

Estimativas, não medições, calculadas a partir dos benchmarks públicos do llama.cpp. Números revisados em 26 de setembro de 2026.

O MacBook Air compartilha a memória entre o processador e a GPU. Com 16 GB, um modelo de 8 bilhões de parâmetros deixa espaço para os seus outros apps; com 8 GB, fique por volta de 4 bilhões.

A velocidade acompanha a largura de banda da memória do chip: cada geração escreve mais rápido, e o M5 lê um documento várias vezes mais rápido que os chips anteriores.

Sem ventoinha, o MacBook Air desacelera depois de alguns minutos de trabalho contínuo: tudo bem para respostas de tamanho normal, nem tanto para sessões longas.

Perguntas sobre rodar um LLM localmente

Qual LLM para um MacBook Air M4 com 16 GB?

O Qwen3 8B ou o Qwen3.5 9B: eles rodam com folga e escrevem cerca de 15 a 21 tokens por segundo. O Twoody instala o Qwen3 8B com um clique.

Um MacBook Air com 8 GB consegue rodar um LLM local?

Sim, um modelo de cerca de 4 bilhões de parâmetros, como o Qwen3 4B, que o Twoody instala nesses Macs. Feche apps pesados enquanto usa.

O MacBook Air esquenta demais rodando um LLM local?

Ele desacelera em vez de superaquecer: sem ventoinha, reduz a velocidade depois de alguns minutos escrevendo sem parar. Nas perguntas do dia a dia, isso não se nota.

Experimente a IA local no seu Mac, de graça.

Versão 0.12.1 · macOS 13 ou posterior · sem conta, sem assinatura. Baixe o app, instale um modelo com um clique e faça sua primeira pergunta — até offline.