Rechner für lokale LLMs
Das beste lokale LLM für Ihren Mac mini
Vom M1 bis zum M6, dazu die Pro-Versionen: das stärkste Modell, das auf dem jeweiligen Mac mini problemlos läuft, und wie schnell es schreibt.
| Ihr Computer | Arbeitsspeicher | Empfohlen – läuft problemlos | Schreibt | Mit einem Klick in Twoody |
|---|---|---|---|---|
M5 Pro — MacBook Pro, Mac mini |
24 GB | gpt-oss-20b | 68–97 Token/s | Qwen3 14B |
| 48 GB | GLM-4.7-Flash | 92–132 Token/s | Qwen3 14B | |
| 64 GB | GLM-4.7-Flash | 92–132 Token/s | Qwen3 14B | |
M6 — Mac mini |
16 GB | Llama 3.1 8B | 17–31 Token/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 30–54 Token/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 36–64 Token/s | Qwen3 14B | |
M4 Pro — MacBook Pro, Mac mini |
24 GB | gpt-oss-20b | 52–74 Token/s | Qwen3 14B |
| 48 GB | GLM-4.7-Flash | 56–81 Token/s | Qwen3 14B | |
| 64 GB | GLM-4.7-Flash | 56–81 Token/s | Qwen3 14B | |
M4 — MacBook Air, MacBook Pro, Mac mini, iMac |
16 GB | Llama 3.1 8B | 15–22 Token/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 25–36 Token/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 32–46 Token/s | Qwen3 14B | |
M2 Pro — MacBook Pro, Mac mini |
16 GB | Llama 3.1 8B | 24–35 Token/s | Qwen3 8B |
| 32 GB | GLM-4.7-Flash | 45–65 Token/s | Qwen3 14B | |
M2 — MacBook Air, MacBook Pro, Mac mini |
8 GB | Llama 3.2 3B | 32–45 Token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 13–19 Token/s | Qwen3 8B | |
| 24 GB | gpt-oss-20b | 23–33 Token/s | Qwen3 14B | |
M1 — MacBook Air, MacBook Pro, Mac mini, iMac |
8 GB | Llama 3.2 3B | 20–29 Token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 8,9–13 Token/s | Qwen3 8B |
Schätzungen, keine Messungen, berechnet aus öffentlichen llama.cpp-Benchmarks. Zahlen geprüft am 26. September 2026.
Der Mac mini ist der günstigste Weg, ein lokales LLM auf einem Mac zu betreiben: ein Modell mit 8 Milliarden Parametern bei 16 GB, ein Mixture-of-Experts-Modell bei 48 GB und einem Pro-Chip.
Leise und immer eingeschaltet, ist ein Mac mini auch genau der Computertyp, den die kommenden Smartphone-Apps aus der Ferne nutzen sollen.
Die Pro-Versionen lesen ihren Speicher mehr als doppelt so schnell wie die Basis-Chips: größere Modelle und schnellere Antworten.
Fragen zu lokalen LLMs
Welches LLM für einen Mac mini M4 mit 16 GB?
Qwen3 8B, Qwen3.5 9B oder Llama 3.1 8B laufen problemlos, mit etwa 15 bis 21 Token pro Sekunde. Twoody installiert Qwen3 8B mit einem Klick.
Lohnt sich ein Mac mini M4 Pro für lokale KI?
Mit 48 oder 64 GB ja: Er führt Mixture-of-Experts-Modelle wie Qwen3 30B-A3B oder gpt-oss-20b mit mehreren Dutzend Token pro Sekunde aus.
Kann ein Mac mini ein lokales LLM für andere Geräte bereitstellen?
Genau das werden die kommenden Smartphone-Apps tun: das Modell Ihres Mac von einem iPhone oder Android-Smartphone aus nutzen, über eine Ende-zu-Ende-verschlüsselte Verbindung.
Das beste lokale LLM, je nach Computer
Probieren Sie lokale KI auf Ihrem Mac aus – kostenlos.
Version 0.12.1 · macOS 13 oder neuer · ohne Konto, ohne Abo. Laden Sie die App herunter, installieren Sie ein Modell mit einem Klick und stellen Sie Ihre erste Frage – sogar offline.