Twoody

Calculadora de LLM local

El mejor LLM local para tu tarjeta gráfica AMD

De la RX 7600 a la RX 9070 XT: el modelo más potente que cabe en la memoria de cada tarjeta y a qué velocidad escribe.

Tu equipo Memoria Recomendados: funcionan con holgura Escribe

Radeon RX 9070 XT (16 GB)

16 GB gpt-oss-20b 100+ tokens/s

Radeon RX 9070 (16 GB)

16 GB gpt-oss-20b 100+ tokens/s

Radeon RX 9060 XT (16 GB)

16 GB gpt-oss-20b 61–107 tokens/s

Radeon RX 9060 XT (8 GB)

8 GB Llama 3.1 8B 42–61 tokens/s

Radeon RX 7900 XTX (24 GB)

24 GB GLM-4.7-Flash 100+ tokens/s

Radeon RX 7900 XT (20 GB)

20 GB gpt-oss-20b 100+ tokens/s

Radeon RX 7900 GRE (16 GB)

16 GB gpt-oss-20b 100+ tokens/s

Radeon RX 7800 XT (16 GB)

16 GB gpt-oss-20b 100+ tokens/s

Radeon RX 7600 XT (16 GB)

16 GB gpt-oss-20b 46–80 tokens/s

Radeon RX 7600 (8 GB)

8 GB Llama 3.1 8B 36–52 tokens/s

Estimaciones, no mediciones, calculadas a partir de los benchmarks públicos de llama.cpp. Cifras revisadas el 26 de septiembre de 2026.

La memoria de la tarjeta decide qué modelos caben: con 16 GB funcionan modelos de 14 000 millones de parámetros o gpt-oss-20b; con los 24 GB de la RX 7900 XTX, de 32 000 millones.

llama.cpp usa las tarjetas Radeon a través de Vulkan: escribir es rápido; leer documentos largos, más lento que con las tarjetas NVIDIA.

Twoody para Windows y Linux está en preparación; la versión en pruebas ejecuta los modelos en el procesador. Mientras tanto, estas velocidades son las de LM Studio u Ollama.

Preguntas sobre los LLM locales

¿Qué LLM elegir para una Radeon RX 7900 XTX?

Con 24 GB, Qwen3 32B o Gemma 4 31B caben en 4 bits, y las mezclas de expertos como gpt-oss-20b escriben muy rápido.

¿Qué cabe en 16 GB de VRAM?

Modelos de hasta 14 000 millones de parámetros en 4 bits, o gpt-oss-20b, con espacio para una conversación larga.

¿Twoody funciona en Linux con una tarjeta AMD?

Todavía no: la versión para Linux está en preparación. Deja tu correo en la página de plataformas y te avisaremos cuando esté lista.

Prueba la IA local en tu Mac, gratis.

Versión 0.12.1 · macOS 13 o posterior · sin cuenta, sin suscripción. Descárgalo, instala un modelo con un clic y haz tu primera pregunta, incluso sin conexión.