Rechner für lokale LLMs
Ein lokales LLM auf Ihrem Intel-Mac
Twoody läuft auf Intel-Macs mit macOS 13 oder neuer. Das Modell nutzt dort den Prozessor: Kleine Modelle funktionieren, aber langsam.
| Ihr Computer | Arbeitsspeicher | Empfohlen – läuft problemlos | Schreibt | Mit einem Klick in Twoody |
|---|---|---|---|---|
MacBook Air, MacBook Pro 13″ (Intel, 2018–2020) |
8 GB | Qwen3 0.6B | 22–65 Token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 3,4–6,1 Token/s | Qwen3 8B | |
| 32 GB | GLM-4.7-Flash | 7,9–14 Token/s | Qwen3 14B | |
MacBook Pro 15″, 16″ (Intel, 2018–2019) |
16 GB | Llama 3.1 8B | 3–5,4 Token/s | Qwen3 8B |
| 32 GB | GLM-4.7-Flash | 7,1–13 Token/s | Qwen3 14B | |
| 64 GB | Qwen3-Next 80B-A3B | 6–11 Token/s | Qwen3 14B | |
iMac, Mac mini (Intel, 2017–2020) |
8 GB | Qwen3 0.6B | 21–62 Token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 3,2–5,7 Token/s | Qwen3 8B | |
| 32 GB | GLM-4.7-Flash | 7,5–13 Token/s | Qwen3 14B | |
| 64 GB | Qwen3-Next 80B-A3B | 6,4–11 Token/s | Qwen3 14B | |
iMac Pro, Mac Pro (2017–2019) |
32 GB | GLM-4.7-Flash | 17–30 Token/s | Qwen3 14B |
| 64 GB | Qwen3-Next 80B-A3B | 14–25 Token/s | Qwen3 14B | |
| 128 GB | Qwen3-Next 80B-A3B | 14–25 Token/s | Qwen3 14B |
Schätzungen, keine Messungen, berechnet aus öffentlichen llama.cpp-Benchmarks. Zahlen geprüft am 26. September 2026.
Auf einem Intel-Mac nutzt llama.cpp den Prozessor, nicht die Grafik: Ein Modell mit etwa 4 Milliarden Parametern schreibt einige Wörter pro Sekunde – genug für kurze Antworten.
Twoody installiert das Qwen3, das zum Arbeitsspeicher passt; auf diesen Macs antwortet das 4B am schnellsten.
LM Studio setzt einen Mac mit Apple Silicon und macOS 14 voraus, Ollama macOS 14: Auf einem Intel-Mac oder unter macOS 13 installiert und startet Twoody ein Modell mit einem Klick.
Fragen zu lokalen LLMs
Funktioniert ein lokales LLM auf einem Intel-Mac?
Ja, auf dem Prozessor: Ein Modell mit 4 Milliarden Parametern schreibt einige Token pro Sekunde, und das Lesen eines langen Dokuments dauert Minuten.
Welche App für lokale KI läuft unter macOS 13?
Twoody läuft unter macOS 13 (Ventura) und neuer, auf Apple Silicon und Intel; die App installiert ein Modell mit einem Klick.
Welches Modell für einen Intel-Mac?
Die kleinsten, die noch nützlich sind: Qwen3 4B oder Qwen3.5 4B. Größere Modelle passen zwar in den Arbeitsspeicher, schreiben aber zu langsam, um angenehm damit zu arbeiten.
Das beste lokale LLM, je nach Computer
Probieren Sie lokale KI auf Ihrem Mac aus – kostenlos.
Version 0.12.1 · macOS 13 oder neuer · ohne Konto, ohne Abo. Laden Sie die App herunter, installieren Sie ein Modell mit einem Klick und stellen Sie Ihre erste Frage – sogar offline.