Twoody

LLM local no Mac

Rode um LLM localmente no seu Mac

Um grande modelo de linguagem pode rodar inteiramente no seu Mac: com privacidade, offline e de graça. Do que você precisa, qual modelo escolher e o jeito mais simples de começar.

Por que rodar um LLM no seu Mac

Suas perguntas e seus arquivos ficam na máquina. Funciona sem internet. Não há assinatura, cota nem conta. A contrapartida: um modelo que cabe em um Mac é menor que os maiores modelos online — excelente para escrever, resumir e trabalhar com seus documentos, nem tanto para os raciocínios mais difíceis.

Do que você precisa

Um Mac com Apple Silicon (M1 ou posterior) roda modelos com folga; um Mac com Intel roda os pequenos, devagar, no processador. A memória decide o modelo: 8 GB para cerca de 4 bilhões de parâmetros, 16 GB para 8 bilhões, 24 GB para 14 bilhões, 48 GB ou mais para os maiores modelos que um notebook comporta.

Qual modelo escolher

O Qwen3 escreve bem em muitos idiomas, em todos os tamanhos; Llama, Gemma, Mistral e gpt-oss são boas alternativas. Comece pelo modelo que cabe com folga na sua memória: um maior, que obriga o Mac a usar swap, fica mais lento que um menor.

Três maneiras de fazer isso

  • Twoody — um app para Mac que sugere o modelo certo para o seu Mac e o instala com um clique; ele lê suas pastas de documentos e as cita. Roda em Macs com Intel e no macOS 13.
  • LM Studio — um app para explorar milhares de modelos e suas configurações. Apple Silicon e macOS 14 ou posterior.
  • Ollama — um motor usado pelo terminal, por uma API ou pelo app dele. macOS 14 ou posterior.

Com o Twoody, em três passos

  1. 1

    Baixe o Twoody para Mac: cerca de 160 MB, notarizado pela Apple.

  2. 2

    Instale o modelo que ele sugere para o seu Mac: de 2,5 a 9 GB, com um clique.

  3. 3

    Faça sua primeira pergunta — e desligue o Wi-Fi, se quiser.

Perguntas frequentes

Rodar um LLM localmente no Mac é gratuito?

Sim: os modelos abertos podem ser baixados de graça, e apps como o Twoody, o LM Studio e o Ollama são gratuitos. O único custo é a memória do seu Mac e a energia elétrica.

De quanta memória preciso para rodar um LLM no Mac?

8 GB para um modelo pequeno como o Qwen3 4B, 16 GB para o Qwen3 8B, 24 GB para o Qwen3 14B. A calculadora mostra o que cabe em cada Mac, e com que velocidade.

Posso rodar um LLM local em um Mac com Intel?

Sim, com o Twoody, no macOS 13 ou posterior: o modelo roda no processador, então os modelos pequenos funcionam, mas devagar. O LM Studio e o Ollama exigem o macOS 14, e o LM Studio, um Mac com Apple Silicon.

Um LLM local é tão bom quanto o ChatGPT?

Para escrever no dia a dia e fazer perguntas sobre seus documentos, muitas vezes chega perto; para as perguntas mais difíceis, não. Em troca, ele é privado, offline e gratuito.

Experimente a IA local no seu Mac, de graça.

Versão 0.12.1 · macOS 13 ou posterior · sem conta, sem assinatura. Baixe o app, instale um modelo com um clique e faça sua primeira pergunta — até offline.