LLM local no Linux
Rode um LLM localmente no Linux
Um grande modelo de linguagem pode rodar inteiramente na sua máquina Linux: com privacidade, offline e de graça. Do que você precisa, qual modelo escolher e o jeito mais simples de começar, com um AppImage ou um pacote .deb.
Por que rodar um LLM na sua máquina
O modelo responde e lê seus arquivos na máquina. Funciona sem internet. Sem assinatura, sem cota e sem precisar de conta. A contrapartida: um modelo que cabe em um computador pessoal é menor que os maiores modelos online — excelente para escrever, resumir e trabalhar com seus documentos, nem tanto para os raciocínios mais difíceis.
Do que você precisa
Um PC x86_64 com Linux. No processador, quem decide é a memória do computador (RAM): 8 GB para cerca de 4 bilhões de parâmetros, 16 GB para 8 bilhões, 24 GB para 14 bilhões. A velocidade da memória conta: a DDR5 escreve mais rápido que a DDR4. Uma placa de vídeo NVIDIA ou AMD acelera muito, com as ferramentas que a usam no Linux.
Qual modelo escolher
O Qwen3.5 escreve bem em muitos idiomas, em todos os tamanhos; Llama, Gemma, Mistral e gpt-oss são boas alternativas. No processador, fique com os modelos pequenos, de cerca de 4 a 9 bilhões de parâmetros: um maior cabe na memória, mas escreve devagar demais para ser confortável.
Três maneiras de fazer isso
- Twoody — o mesmo app do Mac e do Windows: ele sugere o modelo certo para a sua máquina e o instala com um clique, lê suas pastas de documentos e as cita. Em AppImage ou pacote .deb, testado no Ubuntu 24.04; o modelo roda no processador.
- LM Studio — um app para explorar milhares de modelos e suas configurações. Em AppImage, para Ubuntu 20.04 ou posterior, em x64 (com AVX2) e ARM64.
- Ollama — um motor usado pelo terminal ou pela API dele, instalado com um único comando. Ele usa placas NVIDIA (CUDA) e AMD (ROCm).
O que muda em relação ao Mac e ao Windows
É o mesmo app, com as mesmas conversas e os mesmos documentos. No Linux, o modelo roda no processador: o Twoody não usa a placa de vídeo nesse sistema. Por enquanto, as atualizações são manuais: você mesmo baixa a nova versão. E três coisas são exclusivas do Mac: a leitura de PDFs digitalizados, Contatos e Calendário, e o ditado pelo reconhecimento de fala do macOS — no Linux, sua voz é transcrita na máquina pelo whisper.cpp, que já vem com o app.
Com o Twoody, em três passos
-
1
Entre na lista de espera: o Twoody está em beta privado, no Linux e também no Mac e no Windows, e vamos escrever para você quando ele for liberado para você.
-
2
Instale o modelo que ele sugere para a sua máquina: 2,8 ou 5,8 GB, com um clique.
-
3
Faça sua primeira pergunta — e desligue o Wi-Fi, se quiser.
Perguntas frequentes
Rodar um LLM localmente no Linux é gratuito?
Sim: os modelos abertos podem ser baixados de graça, e o Twoody, o LM Studio e o Ollama são gratuitos. O único custo é a memória da sua máquina e a energia elétrica.
O Twoody usa a placa de vídeo no Linux?
Não: no Linux, o Twoody roda o modelo no processador. Para usar uma placa NVIDIA ou AMD, o Ollama e o LM Studio fazem isso no Linux, e o Twoody consegue usar os modelos que eles rodam.
Em quais distribuições o Twoody roda?
O Twoody é testado no Ubuntu 24.04 (x86_64). O AppImage funciona na maioria das distribuições; o pacote .deb instala o Twoody no Debian, no Ubuntu e nos derivados deles.
De quanta memória preciso para rodar um LLM no Linux?
8 GB para um modelo pequeno como o Qwen3.5 4B, 16 GB para o Qwen3.5 9B. A calculadora mostra o que um PC sem placa de vídeo consegue rodar, com memória DDR4 ou DDR5, e com que velocidade.
Posso usar o Twoody no Linux hoje?
No beta privado, sim: o Twoody roda no Linux (x86_64), como no Mac e no Windows. Os downloads são reservados às pessoas do beta: deixe seu e-mail para entrar na lista de espera.
O Twoody está em beta privado.
No Mac, no Windows e no Linux, grátis, sem conta e sem assinatura, e no iPhone e no Android, com o Twoody no seu computador. Deixe seu e-mail: vamos avisar você quando chegar a sua vez.