Calculadora de LLM local
Um LLM local no seu Mac com Intel
O Twoody roda em Macs com Intel e macOS 13 ou posterior. O modelo roda no processador: modelos pequenos funcionam, mas devagar.
| Seu computador | Memória | Recomendado — roda com folga | Escreve | Um clique no Twoody |
|---|---|---|---|---|
MacBook Air, MacBook Pro 13″ Intel (2018–2020) |
8 GB | Qwen3 0.6B | 22–65 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 3,4–6,1 tokens/s | Qwen3 8B | |
| 32 GB | GLM-4.7-Flash | 7,9–14 tokens/s | Qwen3 14B | |
MacBook Pro 15″, 16″ Intel (2018–2019) |
16 GB | Llama 3.1 8B | 3–5,4 tokens/s | Qwen3 8B |
| 32 GB | GLM-4.7-Flash | 7,1–13 tokens/s | Qwen3 14B | |
| 64 GB | Qwen3-Next 80B-A3B | 6–11 tokens/s | Qwen3 14B | |
iMac, Mac mini Intel (2017–2020) |
8 GB | Qwen3 0.6B | 21–62 tokens/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 3,2–5,7 tokens/s | Qwen3 8B | |
| 32 GB | GLM-4.7-Flash | 7,5–13 tokens/s | Qwen3 14B | |
| 64 GB | Qwen3-Next 80B-A3B | 6,4–11 tokens/s | Qwen3 14B | |
iMac Pro, Mac Pro (2017–2019) |
32 GB | GLM-4.7-Flash | 17–30 tokens/s | Qwen3 14B |
| 64 GB | Qwen3-Next 80B-A3B | 14–25 tokens/s | Qwen3 14B | |
| 128 GB | Qwen3-Next 80B-A3B | 14–25 tokens/s | Qwen3 14B |
Estimativas, não medições, calculadas a partir dos benchmarks públicos do llama.cpp. Números revisados em 26 de setembro de 2026.
Em um Mac com Intel, o llama.cpp usa o processador, e não a GPU: um modelo de cerca de 4 bilhões de parâmetros escreve algumas palavras por segundo, o suficiente para respostas curtas.
O Twoody instala o Qwen3 adequado à memória; nesses Macs, o 4B é o que responde mais rápido.
O LM Studio exige um Mac com Apple Silicon e o macOS 14, e o Ollama, o macOS 14: em um Mac com Intel ou com o macOS 13, o Twoody instala e roda um modelo com um clique.
Perguntas sobre rodar um LLM localmente
Um LLM local funciona em um Mac com Intel?
Sim, no processador: um modelo de 4 bilhões de parâmetros escreve alguns tokens por segundo, e ler um documento longo leva minutos.
Qual app de IA local funciona no macOS 13?
O Twoody roda no macOS 13 (Ventura) ou posterior, com Apple Silicon e com Intel; ele instala um modelo com um clique.
Qual modelo para um Mac com Intel?
Os menores que ainda são úteis: o Qwen3 4B ou o Qwen3.5 4B. Modelos maiores cabem na memória, mas escrevem devagar demais para um uso confortável.
O melhor LLM local, por computador
Experimente a IA local no seu Mac, de graça.
Versão 0.12.1 · macOS 13 ou posterior · sem conta, sem assinatura. Baixe o app, instale um modelo com um clique e faça sua primeira pergunta — até offline.