Twoody

Calcolatore di LLM locali

Il miglior LLM locale per il tuo Mac mini

Dall'M1 all'M6, versioni Pro comprese: il modello più potente che gira senza problemi su ogni Mac mini, e a che velocità scrive.

Il tuo computer Memoria Consigliato — gira senza problemi Scrive Con un clic in Twoody

M5 Pro — MacBook Pro, Mac mini

24 GB gpt-oss-20b 68–97 token/s Qwen3 14B
48 GB GLM-4.7-Flash 92–132 token/s Qwen3 14B
64 GB GLM-4.7-Flash 92–132 token/s Qwen3 14B

M6 — Mac mini

16 GB Llama 3.1 8B 17–31 token/s Qwen3 8B
24 GB gpt-oss-20b 30–54 token/s Qwen3 14B
32 GB GLM-4.7-Flash 36–64 token/s Qwen3 14B

M4 Pro — MacBook Pro, Mac mini

24 GB gpt-oss-20b 52–74 token/s Qwen3 14B
48 GB GLM-4.7-Flash 56–81 token/s Qwen3 14B
64 GB GLM-4.7-Flash 56–81 token/s Qwen3 14B

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 GB Llama 3.1 8B 15–22 token/s Qwen3 8B
24 GB gpt-oss-20b 25–36 token/s Qwen3 14B
32 GB GLM-4.7-Flash 32–46 token/s Qwen3 14B

M2 Pro — MacBook Pro, Mac mini

16 GB Llama 3.1 8B 24–35 token/s Qwen3 8B
32 GB GLM-4.7-Flash 45–65 token/s Qwen3 14B

M2 — MacBook Air, MacBook Pro, Mac mini

8 GB Llama 3.2 3B 32–45 token/s Qwen3 4B
16 GB Llama 3.1 8B 13–19 token/s Qwen3 8B
24 GB gpt-oss-20b 23–33 token/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 GB Llama 3.2 3B 20–29 token/s Qwen3 4B
16 GB Llama 3.1 8B 8,9–13 token/s Qwen3 8B

Stime, non misurazioni, calcolate a partire dai benchmark pubblici di llama.cpp. Dati rivisti il 26 settembre 2026.

Il Mac mini è il modo più economico per eseguire un LLM locale su un Mac: un modello da 8 miliardi di parametri con 16 GB, un modello MoE (mixture of experts) con 48 GB e un chip Pro.

Silenzioso e sempre acceso, un Mac mini è anche il tipo di computer che le app per telefono in preparazione sono pensate per usare a distanza.

Le versioni Pro leggono la memoria a più del doppio della velocità dei chip base: modelli più grandi e risposte più rapide.

Domande sull'uso di un LLM in locale

Quale LLM per un Mac mini M4 con 16 GB?

Qwen3 8B, Qwen3.5 9B o Llama 3.1 8B girano senza problemi, a circa 15–21 token al secondo. Twoody installa Qwen3 8B con un clic.

Un Mac mini M4 Pro conviene per l'IA locale?

Con 48 o 64 GB, sì: fa girare modelli MoE come Qwen3 30B-A3B o gpt-oss-20b a diverse decine di token al secondo.

Un Mac mini può servire un LLM locale ad altri dispositivi?

È quello che faranno le app per telefono in preparazione: usare il modello del tuo Mac da un iPhone o da un telefono Android, con una connessione crittografata end-to-end.

Prova l'IA locale sul tuo Mac, gratis.

Versione 0.12.1 · macOS 13 o successivo · senza account, senza abbonamento. Scarica l'app, installa un modello con un clic e fai la tua prima domanda — anche offline.