Calculadora de LLM local
El mejor LLM local para tu tarjeta gráfica AMD
De la RX 7600 a la RX 9070 XT: el modelo más potente que cabe en la memoria de cada tarjeta y a qué velocidad escribe.
| Tu equipo | Memoria | Recomendados: funcionan con holgura | Escribe |
|---|---|---|---|
Radeon RX 9070 XT (16 GB) |
16 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 9070 (16 GB) |
16 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 9060 XT (16 GB) |
16 GB | gpt-oss-20b | 61–107 tokens/s |
Radeon RX 9060 XT (8 GB) |
8 GB | Llama 3.1 8B | 42–61 tokens/s |
Radeon RX 7900 XTX (24 GB) |
24 GB | GLM-4.7-Flash | 100+ tokens/s |
Radeon RX 7900 XT (20 GB) |
20 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7900 GRE (16 GB) |
16 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7800 XT (16 GB) |
16 GB | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7600 XT (16 GB) |
16 GB | gpt-oss-20b | 46–80 tokens/s |
Radeon RX 7600 (8 GB) |
8 GB | Llama 3.1 8B | 36–52 tokens/s |
Estimaciones, no mediciones, calculadas a partir de los benchmarks públicos de llama.cpp. Cifras revisadas el 26 de septiembre de 2026.
La memoria de la tarjeta decide qué modelos caben: con 16 GB funcionan modelos de 14 000 millones de parámetros o gpt-oss-20b; con los 24 GB de la RX 7900 XTX, de 32 000 millones.
llama.cpp usa las tarjetas Radeon a través de Vulkan: escribir es rápido; leer documentos largos, más lento que con las tarjetas NVIDIA.
Twoody para Windows y Linux está en preparación; la versión en pruebas ejecuta los modelos en el procesador. Mientras tanto, estas velocidades son las de LM Studio u Ollama.
Preguntas sobre los LLM locales
¿Qué LLM elegir para una Radeon RX 7900 XTX?
Con 24 GB, Qwen3 32B o Gemma 4 31B caben en 4 bits, y las mezclas de expertos como gpt-oss-20b escriben muy rápido.
¿Qué cabe en 16 GB de VRAM?
Modelos de hasta 14 000 millones de parámetros en 4 bits, o gpt-oss-20b, con espacio para una conversación larga.
¿Twoody funciona en Linux con una tarjeta AMD?
Todavía no: la versión para Linux está en preparación. Deja tu correo en la página de plataformas y te avisaremos cuando esté lista.
El mejor LLM local, por equipo
Prueba la IA local en tu Mac, gratis.
Versión 0.12.1 · macOS 13 o posterior · sin cuenta, sin suscripción. Descárgalo, instala un modelo con un clic y haz tu primera pregunta, incluso sin conexión.