Twoody

Rechner für lokale LLMs

Das beste lokale LLM für Ihren Mac mini

Vom M1 bis zum M6, dazu die Pro-Versionen: das stärkste Modell, das auf dem jeweiligen Mac mini problemlos läuft, und wie schnell es schreibt.

Ihr Computer Arbeitsspeicher Empfohlen – läuft problemlos Schreibt Mit einem Klick in Twoody

M5 Pro — MacBook Pro, Mac mini

24 GB gpt-oss-20b 68–97 Token/s Qwen3 14B
48 GB GLM-4.7-Flash 92–132 Token/s Qwen3 14B
64 GB GLM-4.7-Flash 92–132 Token/s Qwen3 14B

M6 — Mac mini

16 GB Llama 3.1 8B 17–31 Token/s Qwen3 8B
24 GB gpt-oss-20b 30–54 Token/s Qwen3 14B
32 GB GLM-4.7-Flash 36–64 Token/s Qwen3 14B

M4 Pro — MacBook Pro, Mac mini

24 GB gpt-oss-20b 52–74 Token/s Qwen3 14B
48 GB GLM-4.7-Flash 56–81 Token/s Qwen3 14B
64 GB GLM-4.7-Flash 56–81 Token/s Qwen3 14B

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 GB Llama 3.1 8B 15–22 Token/s Qwen3 8B
24 GB gpt-oss-20b 25–36 Token/s Qwen3 14B
32 GB GLM-4.7-Flash 32–46 Token/s Qwen3 14B

M2 Pro — MacBook Pro, Mac mini

16 GB Llama 3.1 8B 24–35 Token/s Qwen3 8B
32 GB GLM-4.7-Flash 45–65 Token/s Qwen3 14B

M2 — MacBook Air, MacBook Pro, Mac mini

8 GB Llama 3.2 3B 32–45 Token/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 Token/s Qwen3 8B
24 GB gpt-oss-20b 23–33 Token/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 GB Llama 3.2 3B 20–29 Token/s Qwen3 4B
16 GB Llama 3.1 8B 8,9–13 Token/s Qwen3 8B

Schätzungen, keine Messungen, berechnet aus öffentlichen llama.cpp-Benchmarks. Zahlen geprüft am 26. September 2026.

Der Mac mini ist der günstigste Weg, ein lokales LLM auf einem Mac zu betreiben: ein Modell mit 8 Milliarden Parametern bei 16 GB, ein Mixture-of-Experts-Modell bei 48 GB und einem Pro-Chip.

Leise und immer eingeschaltet, ist ein Mac mini auch genau der Computertyp, den die kommenden Smartphone-Apps aus der Ferne nutzen sollen.

Die Pro-Versionen lesen ihren Speicher mehr als doppelt so schnell wie die Basis-Chips: größere Modelle und schnellere Antworten.

Fragen zu lokalen LLMs

Welches LLM für einen Mac mini M4 mit 16 GB?

Qwen3 8B, Qwen3.5 9B oder Llama 3.1 8B laufen problemlos, mit etwa 15 bis 21 Token pro Sekunde. Twoody installiert Qwen3 8B mit einem Klick.

Lohnt sich ein Mac mini M4 Pro für lokale KI?

Mit 48 oder 64 GB ja: Er führt Mixture-of-Experts-Modelle wie Qwen3 30B-A3B oder gpt-oss-20b mit mehreren Dutzend Token pro Sekunde aus.

Kann ein Mac mini ein lokales LLM für andere Geräte bereitstellen?

Genau das werden die kommenden Smartphone-Apps tun: das Modell Ihres Mac von einem iPhone oder Android-Smartphone aus nutzen, über eine Ende-zu-Ende-verschlüsselte Verbindung.

Probieren Sie lokale KI auf Ihrem Mac aus – kostenlos.

Version 0.12.1 · macOS 13 oder neuer · ohne Konto, ohne Abo. Laden Sie die App herunter, installieren Sie ein Modell mit einem Klick und stellen Sie Ihre erste Frage – sogar offline.