Twoody

Rechner für lokale LLMs

Das beste lokale LLM für Ihr MacBook Air

Vom M1 bis zum M5, mit 8 bis 32 GB: das stärkste Modell, das auf dem jeweiligen MacBook Air problemlos läuft, und wie schnell es schreibt.

Ihr Computer Arbeitsspeicher Empfohlen – läuft problemlos Schreibt Mit einem Klick in Twoody

M5 — MacBook Air, MacBook Pro

16 GB Llama 3.1 8B 20–28 Token/s Qwen3 8B
24 GB gpt-oss-20b 32–47 Token/s Qwen3 14B
32 GB GLM-4.7-Flash 41–59 Token/s Qwen3 14B

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 GB Llama 3.1 8B 15–22 Token/s Qwen3 8B
24 GB gpt-oss-20b 25–36 Token/s Qwen3 14B
32 GB GLM-4.7-Flash 32–46 Token/s Qwen3 14B

M3 — MacBook Air, MacBook Pro, iMac

8 GB Llama 3.2 3B 31–45 Token/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 Token/s Qwen3 8B
24 GB gpt-oss-20b 23–32 Token/s Qwen3 14B

M2 — MacBook Air, MacBook Pro, Mac mini

8 GB Llama 3.2 3B 32–45 Token/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 Token/s Qwen3 8B
24 GB gpt-oss-20b 23–33 Token/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 GB Llama 3.2 3B 20–29 Token/s Qwen3 4B
16 GB Llama 3.1 8B 8,9–13 Token/s Qwen3 8B

Schätzungen, keine Messungen, berechnet aus öffentlichen llama.cpp-Benchmarks. Zahlen geprüft am 26. September 2026.

Ein MacBook Air teilt seinen Arbeitsspeicher zwischen Prozessor und Grafikeinheit. Mit 16 GB lässt ein Modell mit 8 Milliarden Parametern noch Platz für Ihre anderen Apps; mit 8 GB bleiben Sie besser bei etwa 4 Milliarden.

Das Tempo folgt der Speicherbandbreite des Chips: Jede Generation schreibt schneller, und der M5 liest ein Dokument um ein Mehrfaches schneller als die Chips vor ihm.

Ohne Lüfter wird ein MacBook Air nach einigen Minuten Dauerlast langsamer: kein Problem bei Antworten normaler Länge, eher bei langen Sitzungen.

Fragen zu lokalen LLMs

Welches LLM für ein MacBook Air M4 mit 16 GB?

Qwen3 8B oder Qwen3.5 9B: Sie laufen problemlos und schreiben etwa 15 bis 21 Token pro Sekunde. Twoody installiert Qwen3 8B mit einem Klick.

Kann ein MacBook Air mit 8 GB ein lokales LLM ausführen?

Ja, ein Modell mit etwa 4 Milliarden Parametern wie Qwen3 4B, das Twoody auf diesen Macs installiert. Schließen Sie währenddessen speicherhungrige Apps.

Wird ein MacBook Air zu heiß, wenn ein lokales LLM läuft?

Es wird eher langsamer, als dass es überhitzt: Ohne Lüfter drosselt es nach einigen Minuten ununterbrochenen Schreibens sein Tempo. Bei alltäglichen Fragen merkt man das nicht.

Probieren Sie lokale KI auf Ihrem Mac aus – kostenlos.

Version 0.12.1 · macOS 13 oder neuer · ohne Konto, ohne Abo. Laden Sie die App herunter, installieren Sie ein Modell mit einem Klick und stellen Sie Ihre erste Frage – sogar offline.