Twoody

Calculadora de LLM local

O melhor LLM local para o seu iMac

Do M1 ao M4, com 8 a 32 GB: o modelo mais forte que roda com folga em cada iMac, e com que velocidade ele escreve.

Seu computador Memória Recomendado — roda com folga Escreve Um clique no Twoody

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 GB Llama 3.1 8B 15–22 tokens/s Qwen3 8B
24 GB gpt-oss-20b 25–36 tokens/s Qwen3 14B
32 GB GLM-4.7-Flash 32–46 tokens/s Qwen3 14B

M3 — MacBook Air, MacBook Pro, iMac

8 GB Llama 3.2 3B 31–45 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 GB gpt-oss-20b 23–32 tokens/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 GB Llama 3.2 3B 20–29 tokens/s Qwen3 4B
16 GB Llama 3.1 8B 8,9–13 tokens/s Qwen3 8B

Estimativas, não medições, calculadas a partir dos benchmarks públicos do llama.cpp. Números revisados em 26 de setembro de 2026.

Um iMac com 8 GB roda modelos de cerca de 4 bilhões de parâmetros; com 16 ou 24 GB, de 8 a 14 bilhões — o suficiente para escrever e fazer perguntas sobre seus documentos.

O M3 e o M4 escrevem e leem mais rápido que o M1 com o mesmo modelo; a memória decide quais modelos cabem.

Na mesa o dia todo, o iMac também é um bom computador para ser usado a distância pelos apps para celular em preparação.

Perguntas sobre rodar um LLM localmente

Qual LLM para um iMac com M4?

Com 16 GB, o Qwen3 8B; com 24 ou 32 GB, o Qwen3 14B ou uma mistura de especialistas como o gpt-oss-20b. O Twoody instala o Qwen3 adequado à memória dele.

Um iMac com 8 GB consegue rodar um LLM local?

Sim, um modelo de cerca de 4 bilhões de parâmetros, como o Qwen3 4B, o suficiente para e-mails e resumos.

E um iMac com Intel?

O Twoody roda em iMacs com Intel e macOS 13 ou posterior; o modelo roda no processador, mais devagar. Veja a página sobre Macs com Intel.

Experimente a IA local no seu Mac, de graça.

Versão 0.12.1 · macOS 13 ou posterior · sem conta, sem assinatura. Baixe o app, instale um modelo com um clique e faça sua primeira pergunta — até offline.