Calculateur de LLM local
Le meilleur LLM local pour votre carte graphique AMD
De la RX 7600 à la RX 9070 XT : le modèle le plus fort qui tient dans la mémoire de chaque carte, et à quelle vitesse il écrit.
| Votre ordinateur | Mémoire | Recommandé — tourne confortablement | Écrit |
|---|---|---|---|
Radeon RX 9070 XT (16 GB) |
16 Go | gpt-oss-20b | 100+ tokens/s |
Radeon RX 9070 (16 GB) |
16 Go | gpt-oss-20b | 100+ tokens/s |
Radeon RX 9060 XT (16 GB) |
16 Go | gpt-oss-20b | 61–107 tokens/s |
Radeon RX 9060 XT (8 GB) |
8 Go | Llama 3.1 8B | 42–61 tokens/s |
Radeon RX 7900 XTX (24 GB) |
24 Go | GLM-4.7-Flash | 100+ tokens/s |
Radeon RX 7900 XT (20 GB) |
20 Go | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7900 GRE (16 GB) |
16 Go | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7800 XT (16 GB) |
16 Go | gpt-oss-20b | 100+ tokens/s |
Radeon RX 7600 XT (16 GB) |
16 Go | gpt-oss-20b | 46–80 tokens/s |
Radeon RX 7600 (8 GB) |
8 Go | Llama 3.1 8B | 36–52 tokens/s |
Des estimations, pas des mesures, calculées à partir des benchmarks publics de llama.cpp. Chiffres revus le 26 septembre 2026.
La mémoire de la carte décide des modèles qui tiennent : 16 Go font tourner des modèles de 14 milliards de paramètres ou gpt-oss-20b ; la RX 7900 XTX de 24 Go, 32 milliards.
llama.cpp fait tourner les cartes Radeon avec Vulkan : l'écriture est rapide ; la lecture de longs documents, plus lente que sur les cartes NVIDIA.
Twoody pour Windows et Linux est en préparation ; la version en test fait tourner les modèles sur le processeur. En attendant, ces vitesses sont celles de LM Studio ou d'Ollama.
Questions sur les LLM en local
Quel LLM pour une Radeon RX 7900 XTX ?
Avec 24 Go, Qwen3 32B ou Gemma 4 31B tiennent en 4 bits, et les mélanges d'experts comme gpt-oss-20b écrivent très vite.
Que tient-on dans 16 Go de VRAM ?
Des modèles jusqu'à 14 milliards de paramètres en 4 bits, ou gpt-oss-20b, avec de la place pour une longue conversation.
Twoody tourne-t-il sur Linux avec une carte AMD ?
Pas encore : la version Linux est en préparation. Laissez votre e-mail sur la page des plateformes pour être prévenu quand elle sera prête.
Le meilleur LLM local, par ordinateur
Essayez l'IA locale sur votre Mac, gratuitement.
Version 0.11.5 · macOS 13 ou plus récent · sans compte, sans abonnement. Téléchargez, installez un modèle en un clic, et posez votre première question — même hors ligne.