Calculadora de LLM local
O melhor LLM local para o seu Mac mini
Do M1 ao M6, e as versões Pro: o modelo mais forte que roda com folga em cada Mac mini, e com que velocidade ele escreve.
| Seu computador | Memória | Recomendado — roda com folga | Escreve | Um clique no Twoody |
|---|---|---|---|---|
M5 Pro — MacBook Pro, Mac mini |
24 GB | gpt-oss-20b | 68–97 tokens/s | Qwen3 14B |
| 48 GB | GLM-4.7-Flash | 92–132 tokens/s | Qwen3 14B | |
| 64 GB | GLM-4.7-Flash | 92–132 tokens/s | Qwen3 14B | |
M6 — Mac mini |
16 GB | Llama 3.1 8B | 17–31 tokens/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 30–54 tokens/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 36–64 tokens/s | Qwen3 14B | |
M4 Pro — MacBook Pro, Mac mini |
24 GB | gpt-oss-20b | 52–74 tokens/s | Qwen3 14B |
| 48 GB | GLM-4.7-Flash | 56–81 tokens/s | Qwen3 14B | |
| 64 GB | GLM-4.7-Flash | 56–81 tokens/s | Qwen3 14B | |
M4 — MacBook Air, MacBook Pro, Mac mini, iMac |
16 GB | Llama 3.1 8B | 15–22 tokens/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 25–36 tokens/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 32–46 tokens/s | Qwen3 14B | |
M2 Pro — MacBook Pro, Mac mini |
16 GB | Llama 3.1 8B | 24–35 tokens/s | Qwen3 8B |
| 32 GB | GLM-4.7-Flash | 45–65 tokens/s | Qwen3 14B | |
M2 — MacBook Air, MacBook Pro, Mac mini |
8 GB | Llama 3.2 3B | 32–45 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 13–19 tokens/s | Qwen3 8B | |
| 24 GB | gpt-oss-20b | 23–33 tokens/s | Qwen3 14B | |
M1 — MacBook Air, MacBook Pro, Mac mini, iMac |
8 GB | Llama 3.2 3B | 20–29 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 8,9–13 tokens/s | Qwen3 8B |
Estimativas, não medições, calculadas a partir dos benchmarks públicos do llama.cpp. Números revisados em 26 de setembro de 2026.
O Mac mini é o jeito mais barato de rodar um LLM local em um Mac: um modelo de 8 bilhões de parâmetros com 16 GB, uma mistura de especialistas com 48 GB e um chip Pro.
Silencioso e sempre ligado, o Mac mini também é o tipo de computador que os apps para celular em preparação foram feitos para usar a distância.
As versões Pro leem a memória mais de duas vezes mais rápido que os chips básicos: modelos maiores e respostas mais rápidas.
Perguntas sobre rodar um LLM localmente
Qual LLM para um Mac mini M4 com 16 GB?
O Qwen3 8B, o Qwen3.5 9B ou o Llama 3.1 8B rodam com folga, a cerca de 15 a 21 tokens por segundo. O Twoody instala o Qwen3 8B com um clique.
Vale a pena um Mac mini M4 Pro para IA local?
Com 48 ou 64 GB, sim: ele roda misturas de especialistas como o Qwen3 30B-A3B ou o gpt-oss-20b a várias dezenas de tokens por segundo.
Um Mac mini pode servir um LLM local para outros dispositivos?
É isso que os apps para celular em preparação vão fazer: usar o modelo do seu Mac a partir de um iPhone ou de um celular Android, com uma conexão criptografada de ponta a ponta.
O melhor LLM local, por computador
Experimente a IA local no seu Mac, de graça.
Versão 0.12.1 · macOS 13 ou posterior · sem conta, sem assinatura. Baixe o app, instale um modelo com um clique e faça sua primeira pergunta — até offline.