Twoody

Calculateur de LLM local

Le meilleur LLM local pour votre carte graphique AMD

De la RX 7600 à la RX 9070 XT : le modèle le plus fort qui tient dans la mémoire de chaque carte, et à quelle vitesse il écrit.

Votre ordinateur Mémoire Recommandé — tourne confortablement Écrit

Radeon RX 9070 XT (16 GB)

16 Go gpt-oss-20b 100+ tokens/s

Radeon RX 9070 (16 GB)

16 Go gpt-oss-20b 100+ tokens/s

Radeon RX 9060 XT (16 GB)

16 Go gpt-oss-20b 61–107 tokens/s

Radeon RX 9060 XT (8 GB)

8 Go Llama 3.1 8B 42–61 tokens/s

Radeon RX 7900 XTX (24 GB)

24 Go GLM-4.7-Flash 100+ tokens/s

Radeon RX 7900 XT (20 GB)

20 Go gpt-oss-20b 100+ tokens/s

Radeon RX 7900 GRE (16 GB)

16 Go gpt-oss-20b 100+ tokens/s

Radeon RX 7800 XT (16 GB)

16 Go gpt-oss-20b 100+ tokens/s

Radeon RX 7600 XT (16 GB)

16 Go gpt-oss-20b 46–80 tokens/s

Radeon RX 7600 (8 GB)

8 Go Llama 3.1 8B 36–52 tokens/s

Des estimations, pas des mesures, calculées à partir des benchmarks publics de llama.cpp. Chiffres revus le 26 septembre 2026.

La mémoire de la carte décide des modèles qui tiennent : 16 Go font tourner des modèles de 14 milliards de paramètres ou gpt-oss-20b ; la RX 7900 XTX de 24 Go, 32 milliards.

llama.cpp fait tourner les cartes Radeon avec Vulkan : l'écriture est rapide ; la lecture de longs documents, plus lente que sur les cartes NVIDIA.

Twoody pour Windows et Linux est en préparation ; la version en test fait tourner les modèles sur le processeur. En attendant, ces vitesses sont celles de LM Studio ou d'Ollama.

Questions sur les LLM en local

Quel LLM pour une Radeon RX 7900 XTX ?

Avec 24 Go, Qwen3 32B ou Gemma 4 31B tiennent en 4 bits, et les mélanges d'experts comme gpt-oss-20b écrivent très vite.

Que tient-on dans 16 Go de VRAM ?

Des modèles jusqu'à 14 milliards de paramètres en 4 bits, ou gpt-oss-20b, avec de la place pour une longue conversation.

Twoody tourne-t-il sur Linux avec une carte AMD ?

Pas encore : la version Linux est en préparation. Laissez votre e-mail sur la page des plateformes pour être prévenu quand elle sera prête.

Essayez l'IA locale sur votre Mac, gratuitement.

Version 0.11.5 · macOS 13 ou plus récent · sans compte, sans abonnement. Téléchargez, installez un modèle en un clic, et posez votre première question — même hors ligne.