Rechner für lokale LLMs
Das beste lokale LLM für Ihre AMD-Grafikkarte
Von der RX 7600 bis zur RX 9070 XT: das stärkste Modell, das in den Speicher der jeweiligen Karte passt, und wie schnell es schreibt.
| Ihr Computer | Arbeitsspeicher | Empfohlen – läuft problemlos | Schreibt |
|---|---|---|---|
Radeon RX 9070 XT (16 GB) |
16 GB | gpt-oss-20b | 100+ Token/s |
Radeon RX 9070 (16 GB) |
16 GB | gpt-oss-20b | 100+ Token/s |
Radeon RX 9060 XT (16 GB) |
16 GB | gpt-oss-20b | 61–107 Token/s |
Radeon RX 9060 XT (8 GB) |
8 GB | Llama 3.1 8B | 42–61 Token/s |
Radeon RX 7900 XTX (24 GB) |
24 GB | GLM-4.7-Flash | 100+ Token/s |
Radeon RX 7900 XT (20 GB) |
20 GB | gpt-oss-20b | 100+ Token/s |
Radeon RX 7900 GRE (16 GB) |
16 GB | gpt-oss-20b | 100+ Token/s |
Radeon RX 7800 XT (16 GB) |
16 GB | gpt-oss-20b | 100+ Token/s |
Radeon RX 7600 XT (16 GB) |
16 GB | gpt-oss-20b | 46–80 Token/s |
Radeon RX 7600 (8 GB) |
8 GB | Llama 3.1 8B | 36–52 Token/s |
Schätzungen, keine Messungen, berechnet aus öffentlichen llama.cpp-Benchmarks. Zahlen geprüft am 26. September 2026.
Der Speicher der Karte entscheidet, welche Modelle passen: Mit 16 GB laufen Modelle mit 14 Milliarden Parametern oder gpt-oss-20b, auf der RX 7900 XTX mit 24 GB solche mit 32 Milliarden.
llama.cpp nutzt Radeon-Karten über Vulkan: Das Schreiben ist schnell, das Lesen langer Dokumente langsamer als auf NVIDIA-Karten.
Twoody für Windows und Linux ist in Vorbereitung; die Version, die gerade getestet wird, lässt die Modelle auf dem Prozessor laufen. Bis dahin zeigen diese Werte das Tempo von LM Studio oder Ollama.
Fragen zu lokalen LLMs
Welches LLM für eine Radeon RX 7900 XTX?
Mit 24 GB passen Qwen3 32B oder Gemma 4 31B in 4 Bit, und Mixture-of-Experts-Modelle wie gpt-oss-20b schreiben sehr schnell.
Was passt in 16 GB VRAM?
Modelle mit bis zu 14 Milliarden Parametern in 4 Bit oder gpt-oss-20b, mit Platz für eine lange Unterhaltung.
Läuft Twoody unter Linux mit einer AMD-Karte?
Noch nicht: Die Linux-Version ist in Vorbereitung. Hinterlassen Sie auf der Seite „Plattformen“ Ihre E-Mail-Adresse, um benachrichtigt zu werden, sobald sie bereit ist.
Das beste lokale LLM, je nach Computer
Probieren Sie lokale KI auf Ihrem Mac aus – kostenlos.
Version 0.12.1 · macOS 13 oder neuer · ohne Konto, ohne Abo. Laden Sie die App herunter, installieren Sie ein Modell mit einem Klick und stellen Sie Ihre erste Frage – sogar offline.