Twoody

Calculadora de LLM local

Um LLM local no seu Mac com Intel

O Twoody roda em Macs com Intel e macOS 13 ou posterior. O modelo roda no processador: modelos pequenos funcionam, mas devagar.

Seu computador Memória Recomendado — roda com folga Escreve Um clique no Twoody

MacBook Air, MacBook Pro 13″ Intel (2018–2020)

8 GB Qwen3 0.6B 22–65 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 3,4–6,1 tokens/s Qwen3 8B
32 GB GLM-4.7-Flash 7,9–14 tokens/s Qwen3 14B

MacBook Pro 15″, 16″ Intel (2018–2019)

16 GB Llama 3.1 8B 3–5,4 tokens/s Qwen3 8B
32 GB GLM-4.7-Flash 7,1–13 tokens/s Qwen3 14B
64 GB Qwen3-Next 80B-A3B 6–11 tokens/s Qwen3 14B

iMac, Mac mini Intel (2017–2020)

8 GB Qwen3 0.6B 21–62 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 3,2–5,7 tokens/s Qwen3 8B
32 GB GLM-4.7-Flash 7,5–13 tokens/s Qwen3 14B
64 GB Qwen3-Next 80B-A3B 6,4–11 tokens/s Qwen3 14B

iMac Pro, Mac Pro (2017–2019)

32 GB GLM-4.7-Flash 17–30 tokens/s Qwen3 14B
64 GB Qwen3-Next 80B-A3B 14–25 tokens/s Qwen3 14B
128 GB Qwen3-Next 80B-A3B 14–25 tokens/s Qwen3 14B

Estimativas, não medições, calculadas a partir dos benchmarks públicos do llama.cpp. Números revisados em 26 de setembro de 2026.

Em um Mac com Intel, o llama.cpp usa o processador, e não a GPU: um modelo de cerca de 4 bilhões de parâmetros escreve algumas palavras por segundo, o suficiente para respostas curtas.

O Twoody instala o Qwen3 adequado à memória; nesses Macs, o 4B é o que responde mais rápido.

O LM Studio exige um Mac com Apple Silicon e o macOS 14, e o Ollama, o macOS 14: em um Mac com Intel ou com o macOS 13, o Twoody instala e roda um modelo com um clique.

Perguntas sobre rodar um LLM localmente

Um LLM local funciona em um Mac com Intel?

Sim, no processador: um modelo de 4 bilhões de parâmetros escreve alguns tokens por segundo, e ler um documento longo leva minutos.

Qual app de IA local funciona no macOS 13?

O Twoody roda no macOS 13 (Ventura) ou posterior, com Apple Silicon e com Intel; ele instala um modelo com um clique.

Qual modelo para um Mac com Intel?

Os menores que ainda são úteis: o Qwen3 4B ou o Qwen3.5 4B. Modelos maiores cabem na memória, mas escrevem devagar demais para um uso confortável.

Experimente a IA local no seu Mac, de graça.

Versão 0.12.1 · macOS 13 ou posterior · sem conta, sem assinatura. Baixe o app, instale um modelo com um clique e faça sua primeira pergunta — até offline.