Calculadora de LLM local
O melhor LLM local para a sua placa de vídeo AMD
Da RX 7600 à RX 9070 XT: o modelo mais forte que cabe na memória de cada placa, e com que velocidade ele escreve.
| Seu computador | Memória | Recomendado — roda com folga | Escreve |
|---|---|---|---|
Radeon RX 9070 XT (16 GB) |
16 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 9070 (16 GB) |
16 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 9060 XT (16 GB) |
16 GB | gpt-oss-20b | 61–107 tokens/s |
Radeon RX 9060 XT (8 GB) |
8 GB | Llama 3.1 8B | 42–61 tokens/s |
Radeon RX 7900 XTX (24 GB) |
24 GB | GLM-4.7-Flash | 100+ tokens/s |
Radeon RX 7900 XT (20 GB) |
20 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7900 GRE (16 GB) |
16 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7800 XT (16 GB) |
16 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7600 XT (16 GB) |
16 GB | gpt-oss-20b | 46–80 tokens/s |
Radeon RX 7600 (8 GB) |
8 GB | Llama 3.1 8B | 36–52 tokens/s |
Estimativas, não medições, calculadas a partir dos benchmarks públicos do llama.cpp. Números revisados em 26 de setembro de 2026.
A memória da placa decide quais modelos cabem: com 16 GB, rodam modelos de 14 bilhões de parâmetros ou o gpt-oss-20b; na RX 7900 XTX, de 24 GB, os de 32 bilhões.
O llama.cpp usa as placas Radeon pelo Vulkan: a escrita é rápida; a leitura de documentos longos é mais lenta que nas placas NVIDIA.
O Twoody para Windows e Linux está em preparação; a versão em testes roda os modelos no processador. Por enquanto, estas velocidades são as do LM Studio ou do Ollama.
Perguntas sobre rodar um LLM localmente
Qual LLM para uma Radeon RX 7900 XTX?
Com 24 GB, o Qwen3 32B ou o Gemma 4 31B cabem em 4 bits, e misturas de especialistas como o gpt-oss-20b escrevem muito rápido.
O que cabe em 16 GB de VRAM?
Modelos de até 14 bilhões de parâmetros em 4 bits, ou o gpt-oss-20b, com espaço para uma conversa longa.
O Twoody roda no Linux com uma placa AMD?
Ainda não: a versão para Linux está em preparação. Deixe seu e-mail na página de plataformas para receber um aviso quando ela estiver pronta.
O melhor LLM local, por computador
Experimente a IA local no seu Mac, de graça.
Versão 0.12.1 · macOS 13 ou posterior · sem conta, sem assinatura. Baixe o app, instale um modelo com um clique e faça sua primeira pergunta — até offline.