Rechner für lokale LLMs
Das beste lokale LLM für Ihr MacBook Air
Vom M1 bis zum M5, mit 8 bis 32 GB: das stärkste Modell, das auf dem jeweiligen MacBook Air problemlos läuft, und wie schnell es schreibt.
| Ihr Computer | Arbeitsspeicher | Empfohlen – läuft problemlos | Schreibt | Mit einem Klick in Twoody |
|---|---|---|---|---|
M5 — MacBook Air, MacBook Pro |
16 GB | Llama 3.1 8B | 20–28 Token/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 32–47 Token/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 41–59 Token/s | Qwen3 14B | |
M4 — MacBook Air, MacBook Pro, Mac mini, iMac |
16 GB | Llama 3.1 8B | 15–22 Token/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 25–36 Token/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 32–46 Token/s | Qwen3 14B | |
M3 — MacBook Air, MacBook Pro, iMac |
8 GB | Llama 3.2 3B | 31–45 Token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 13–19 Token/s | Qwen3 8B | |
| 24 GB | gpt-oss-20b | 23–32 Token/s | Qwen3 14B | |
M2 — MacBook Air, MacBook Pro, Mac mini |
8 GB | Llama 3.2 3B | 32–45 Token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 13–19 Token/s | Qwen3 8B | |
| 24 GB | gpt-oss-20b | 23–33 Token/s | Qwen3 14B | |
M1 — MacBook Air, MacBook Pro, Mac mini, iMac |
8 GB | Llama 3.2 3B | 20–29 Token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 8,9–13 Token/s | Qwen3 8B |
Schätzungen, keine Messungen, berechnet aus öffentlichen llama.cpp-Benchmarks. Zahlen geprüft am 26. September 2026.
Ein MacBook Air teilt seinen Arbeitsspeicher zwischen Prozessor und Grafikeinheit. Mit 16 GB lässt ein Modell mit 8 Milliarden Parametern noch Platz für Ihre anderen Apps; mit 8 GB bleiben Sie besser bei etwa 4 Milliarden.
Das Tempo folgt der Speicherbandbreite des Chips: Jede Generation schreibt schneller, und der M5 liest ein Dokument um ein Mehrfaches schneller als die Chips vor ihm.
Ohne Lüfter wird ein MacBook Air nach einigen Minuten Dauerlast langsamer: kein Problem bei Antworten normaler Länge, eher bei langen Sitzungen.
Fragen zu lokalen LLMs
Welches LLM für ein MacBook Air M4 mit 16 GB?
Qwen3 8B oder Qwen3.5 9B: Sie laufen problemlos und schreiben etwa 15 bis 21 Token pro Sekunde. Twoody installiert Qwen3 8B mit einem Klick.
Kann ein MacBook Air mit 8 GB ein lokales LLM ausführen?
Ja, ein Modell mit etwa 4 Milliarden Parametern wie Qwen3 4B, das Twoody auf diesen Macs installiert. Schließen Sie währenddessen speicherhungrige Apps.
Wird ein MacBook Air zu heiß, wenn ein lokales LLM läuft?
Es wird eher langsamer, als dass es überhitzt: Ohne Lüfter drosselt es nach einigen Minuten ununterbrochenen Schreibens sein Tempo. Bei alltäglichen Fragen merkt man das nicht.
Das beste lokale LLM, je nach Computer
Probieren Sie lokale KI auf Ihrem Mac aus – kostenlos.
Version 0.12.1 · macOS 13 oder neuer · ohne Konto, ohne Abo. Laden Sie die App herunter, installieren Sie ein Modell mit einem Klick und stellen Sie Ihre erste Frage – sogar offline.