Twoody

LLM local no Linux

Rode um LLM localmente no Linux

Um grande modelo de linguagem pode rodar inteiramente na sua máquina Linux: com privacidade, offline e de graça. Do que você precisa, qual modelo escolher e o jeito mais simples de começar, com um AppImage ou um pacote .deb.

Por que rodar um LLM na sua máquina

O modelo responde e lê seus arquivos na máquina. Funciona sem internet. Sem assinatura, sem cota e sem precisar de conta. A contrapartida: um modelo que cabe em um computador pessoal é menor que os maiores modelos online — excelente para escrever, resumir e trabalhar com seus documentos, nem tanto para os raciocínios mais difíceis.

Do que você precisa

Um PC x86_64 com Linux. No processador, quem decide é a memória do computador (RAM): 8 GB para cerca de 4 bilhões de parâmetros, 16 GB para 8 bilhões, 24 GB para 14 bilhões. A velocidade da memória conta: a DDR5 escreve mais rápido que a DDR4. Uma placa de vídeo NVIDIA ou AMD acelera muito, com as ferramentas que a usam no Linux.

Qual modelo escolher

O Qwen3.5 escreve bem em muitos idiomas, em todos os tamanhos; Llama, Gemma, Mistral e gpt-oss são boas alternativas. No processador, fique com os modelos pequenos, de cerca de 4 a 9 bilhões de parâmetros: um maior cabe na memória, mas escreve devagar demais para ser confortável.

Três maneiras de fazer isso

  • Twoody — o mesmo app do Mac e do Windows: ele sugere o modelo certo para a sua máquina e o instala com um clique, lê suas pastas de documentos e as cita. Em AppImage ou pacote .deb, testado no Ubuntu 24.04; o modelo roda no processador.
  • LM Studio — um app para explorar milhares de modelos e suas configurações. Em AppImage, para Ubuntu 20.04 ou posterior, em x64 (com AVX2) e ARM64.
  • Ollama — um motor usado pelo terminal ou pela API dele, instalado com um único comando. Ele usa placas NVIDIA (CUDA) e AMD (ROCm).

O que muda em relação ao Mac e ao Windows

É o mesmo app, com as mesmas conversas e os mesmos documentos. No Linux, o modelo roda no processador: o Twoody não usa a placa de vídeo nesse sistema. Por enquanto, as atualizações são manuais: você mesmo baixa a nova versão. E três coisas são exclusivas do Mac: a leitura de PDFs digitalizados, Contatos e Calendário, e o ditado pelo reconhecimento de fala do macOS — no Linux, sua voz é transcrita na máquina pelo whisper.cpp, que já vem com o app.

Com o Twoody, em três passos

  1. 1

    Entre na lista de espera: o Twoody está em beta privado, no Linux e também no Mac e no Windows, e vamos escrever para você quando ele for liberado para você.

  2. 2

    Instale o modelo que ele sugere para a sua máquina: 2,8 ou 5,8 GB, com um clique.

  3. 3

    Faça sua primeira pergunta — e desligue o Wi-Fi, se quiser.

Perguntas frequentes

Rodar um LLM localmente no Linux é gratuito?

Sim: os modelos abertos podem ser baixados de graça, e o Twoody, o LM Studio e o Ollama são gratuitos. O único custo é a memória da sua máquina e a energia elétrica.

O Twoody usa a placa de vídeo no Linux?

Não: no Linux, o Twoody roda o modelo no processador. Para usar uma placa NVIDIA ou AMD, o Ollama e o LM Studio fazem isso no Linux, e o Twoody consegue usar os modelos que eles rodam.

Em quais distribuições o Twoody roda?

O Twoody é testado no Ubuntu 24.04 (x86_64). O AppImage funciona na maioria das distribuições; o pacote .deb instala o Twoody no Debian, no Ubuntu e nos derivados deles.

De quanta memória preciso para rodar um LLM no Linux?

8 GB para um modelo pequeno como o Qwen3.5 4B, 16 GB para o Qwen3.5 9B. A calculadora mostra o que um PC sem placa de vídeo consegue rodar, com memória DDR4 ou DDR5, e com que velocidade.

Posso usar o Twoody no Linux hoje?

No beta privado, sim: o Twoody roda no Linux (x86_64), como no Mac e no Windows. Os downloads são reservados às pessoas do beta: deixe seu e-mail para entrar na lista de espera.

O Twoody está em beta privado.

No Mac, no Windows e no Linux, grátis, sem conta e sem assinatura, e no iPhone e no Android, com o Twoody no seu computador. Deixe seu e-mail: vamos avisar você quando chegar a sua vez.