Twoody

Rechner für lokale LLMs

Ein lokales LLM auf Ihrem Intel-Mac

Twoody läuft auf Intel-Macs mit macOS 13 oder neuer. Das Modell nutzt dort den Prozessor: Kleine Modelle funktionieren, aber langsam.

Ihr Computer Arbeitsspeicher Empfohlen – läuft problemlos Schreibt Mit einem Klick in Twoody

MacBook Air, MacBook Pro 13″ (Intel, 2018–2020)

8 GB Qwen3 0.6B 22–65 Token/s Qwen3 4B
16 GB Llama 3.1 8B 3,4–6,1 Token/s Qwen3 8B
32 GB GLM-4.7-Flash 7,9–14 Token/s Qwen3 14B

MacBook Pro 15″, 16″ (Intel, 2018–2019)

16 GB Llama 3.1 8B 3–5,4 Token/s Qwen3 8B
32 GB GLM-4.7-Flash 7,1–13 Token/s Qwen3 14B
64 GB Qwen3-Next 80B-A3B 6–11 Token/s Qwen3 14B

iMac, Mac mini (Intel, 2017–2020)

8 GB Qwen3 0.6B 21–62 Token/s Qwen3 4B
16 GB Llama 3.1 8B 3,2–5,7 Token/s Qwen3 8B
32 GB GLM-4.7-Flash 7,5–13 Token/s Qwen3 14B
64 GB Qwen3-Next 80B-A3B 6,4–11 Token/s Qwen3 14B

iMac Pro, Mac Pro (2017–2019)

32 GB GLM-4.7-Flash 17–30 Token/s Qwen3 14B
64 GB Qwen3-Next 80B-A3B 14–25 Token/s Qwen3 14B
128 GB Qwen3-Next 80B-A3B 14–25 Token/s Qwen3 14B

Schätzungen, keine Messungen, berechnet aus öffentlichen llama.cpp-Benchmarks. Zahlen geprüft am 26. September 2026.

Auf einem Intel-Mac nutzt llama.cpp den Prozessor, nicht die Grafik: Ein Modell mit etwa 4 Milliarden Parametern schreibt einige Wörter pro Sekunde – genug für kurze Antworten.

Twoody installiert das Qwen3, das zum Arbeitsspeicher passt; auf diesen Macs antwortet das 4B am schnellsten.

LM Studio setzt einen Mac mit Apple Silicon und macOS 14 voraus, Ollama macOS 14: Auf einem Intel-Mac oder unter macOS 13 installiert und startet Twoody ein Modell mit einem Klick.

Fragen zu lokalen LLMs

Funktioniert ein lokales LLM auf einem Intel-Mac?

Ja, auf dem Prozessor: Ein Modell mit 4 Milliarden Parametern schreibt einige Token pro Sekunde, und das Lesen eines langen Dokuments dauert Minuten.

Welche App für lokale KI läuft unter macOS 13?

Twoody läuft unter macOS 13 (Ventura) und neuer, auf Apple Silicon und Intel; die App installiert ein Modell mit einem Klick.

Welches Modell für einen Intel-Mac?

Die kleinsten, die noch nützlich sind: Qwen3 4B oder Qwen3.5 4B. Größere Modelle passen zwar in den Arbeitsspeicher, schreiben aber zu langsam, um angenehm damit zu arbeiten.

Probieren Sie lokale KI auf Ihrem Mac aus – kostenlos.

Version 0.12.1 · macOS 13 oder neuer · ohne Konto, ohne Abo. Laden Sie die App herunter, installieren Sie ein Modell mit einem Klick und stellen Sie Ihre erste Frage – sogar offline.