Calcolatore di LLM locali
Il miglior LLM locale per il tuo Mac mini
Dall'M1 all'M6, versioni Pro comprese: il modello più potente che gira senza problemi su ogni Mac mini, e a che velocità scrive.
| Il tuo computer | Memoria | Consigliato — gira senza problemi | Scrive | Con un clic in Twoody |
|---|---|---|---|---|
M5 Pro — MacBook Pro, Mac mini |
24 GB | gpt-oss-20b | 68–97 token/s | Qwen3 14B |
| 48 GB | GLM-4.7-Flash | 92–132 token/s | Qwen3 14B | |
| 64 GB | GLM-4.7-Flash | 92–132 token/s | Qwen3 14B | |
M6 — Mac mini |
16 GB | Llama 3.1 8B | 17–31 token/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 30–54 token/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 36–64 token/s | Qwen3 14B | |
M4 Pro — MacBook Pro, Mac mini |
24 GB | gpt-oss-20b | 52–74 token/s | Qwen3 14B |
| 48 GB | GLM-4.7-Flash | 56–81 token/s | Qwen3 14B | |
| 64 GB | GLM-4.7-Flash | 56–81 token/s | Qwen3 14B | |
M4 — MacBook Air, MacBook Pro, Mac mini, iMac |
16 GB | Llama 3.1 8B | 15–22 token/s | Qwen3 8B |
| 24 GB | gpt-oss-20b | 25–36 token/s | Qwen3 14B | |
| 32 GB | GLM-4.7-Flash | 32–46 token/s | Qwen3 14B | |
M2 Pro — MacBook Pro, Mac mini |
16 GB | Llama 3.1 8B | 24–35 token/s | Qwen3 8B |
| 32 GB | GLM-4.7-Flash | 45–65 token/s | Qwen3 14B | |
M2 — MacBook Air, MacBook Pro, Mac mini |
8 GB | Llama 3.2 3B | 32–45 token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 13–19 token/s | Qwen3 8B | |
| 24 GB | gpt-oss-20b | 23–33 token/s | Qwen3 14B | |
M1 — MacBook Air, MacBook Pro, Mac mini, iMac |
8 GB | Llama 3.2 3B | 20–29 token/s | Qwen3 4B |
| 16 GB | Llama 3.1 8B | 8,9–13 token/s | Qwen3 8B |
Stime, non misurazioni, calcolate a partire dai benchmark pubblici di llama.cpp. Dati rivisti il 26 settembre 2026.
Il Mac mini è il modo più economico per eseguire un LLM locale su un Mac: un modello da 8 miliardi di parametri con 16 GB, un modello MoE (mixture of experts) con 48 GB e un chip Pro.
Silenzioso e sempre acceso, un Mac mini è anche il tipo di computer che le app per telefono in preparazione sono pensate per usare a distanza.
Le versioni Pro leggono la memoria a più del doppio della velocità dei chip base: modelli più grandi e risposte più rapide.
Domande sull'uso di un LLM in locale
Quale LLM per un Mac mini M4 con 16 GB?
Qwen3 8B, Qwen3.5 9B o Llama 3.1 8B girano senza problemi, a circa 15–21 token al secondo. Twoody installa Qwen3 8B con un clic.
Un Mac mini M4 Pro conviene per l'IA locale?
Con 48 o 64 GB, sì: fa girare modelli MoE come Qwen3 30B-A3B o gpt-oss-20b a diverse decine di token al secondo.
Un Mac mini può servire un LLM locale ad altri dispositivi?
È quello che faranno le app per telefono in preparazione: usare il modello del tuo Mac da un iPhone o da un telefono Android, con una connessione crittografata end-to-end.
Il miglior LLM locale, computer per computer
Prova l'IA locale sul tuo Mac, gratis.
Versione 0.12.1 · macOS 13 o successivo · senza account, senza abbonamento. Scarica l'app, installa un modello con un clic e fai la tua prima domanda — anche offline.