Twoody

Calculateur de LLM local

Le meilleur LLM local pour votre Mac mini

Du M1 au M6, et les versions Pro : le modèle le plus fort qui tourne confortablement sur chaque Mac mini, et à quelle vitesse il écrit.

Votre ordinateur Mémoire Recommandé — tourne confortablement Écrit En un clic dans Twoody

M5 Pro — MacBook Pro, Mac mini

24 Go gpt-oss-20b 68–97 tokens/s Qwen3 14B
48 Go GLM-4.7-Flash 92–132 tokens/s Qwen3 14B
64 Go GLM-4.7-Flash 92–132 tokens/s Qwen3 14B

M6 — Mac mini

16 Go Llama 3.1 8B 17–31 tokens/s Qwen3 8B
24 Go gpt-oss-20b 30–54 tokens/s Qwen3 14B
32 Go GLM-4.7-Flash 36–64 tokens/s Qwen3 14B

M4 Pro — MacBook Pro, Mac mini

24 Go gpt-oss-20b 52–74 tokens/s Qwen3 14B
48 Go GLM-4.7-Flash 56–81 tokens/s Qwen3 14B
64 Go GLM-4.7-Flash 56–81 tokens/s Qwen3 14B

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 Go Llama 3.1 8B 15–22 tokens/s Qwen3 8B
24 Go gpt-oss-20b 25–36 tokens/s Qwen3 14B
32 Go GLM-4.7-Flash 32–46 tokens/s Qwen3 14B

M2 Pro — MacBook Pro, Mac mini

16 Go Llama 3.1 8B 24–35 tokens/s Qwen3 8B
32 Go GLM-4.7-Flash 45–65 tokens/s Qwen3 14B

M2 — MacBook Air, MacBook Pro, Mac mini

8 Go Llama 3.2 3B 32–45 tokens/s Qwen3 4B
16 Go Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 Go gpt-oss-20b 23–33 tokens/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 Go Llama 3.2 3B 20–29 tokens/s Qwen3 4B
16 Go Llama 3.1 8B 8,9–13 tokens/s Qwen3 8B

Des estimations, pas des mesures, calculées à partir des benchmarks publics de llama.cpp. Chiffres revus le 26 septembre 2026.

Le Mac mini est la façon la moins chère de faire tourner un LLM local sur Mac : un modèle de 8 milliards de paramètres avec 16 Go, un mélange d'experts avec 48 Go et une puce Pro.

Silencieux et toujours allumé, un Mac mini est aussi le genre d'ordinateur que les apps pour téléphone en préparation sont faites pour utiliser à distance.

Les versions Pro lisent leur mémoire plus de deux fois plus vite que les puces de base : de plus grands modèles, et des réponses plus rapides.

Questions sur les LLM en local

Quel LLM pour un Mac mini M4 de 16 Go ?

Qwen3 8B, Qwen3.5 9B ou Llama 3.1 8B tournent confortablement, à environ 15 à 21 tokens par seconde. Twoody installe Qwen3 8B en un clic.

Un Mac mini M4 Pro vaut-il le coup pour l'IA locale ?

Avec 48 ou 64 Go, oui : il fait tourner des mélanges d'experts comme Qwen3 30B-A3B ou gpt-oss-20b à plusieurs dizaines de tokens par seconde.

Un Mac mini peut-il servir un LLM local à d'autres appareils ?

C'est ce que feront les apps pour téléphone en préparation : utiliser le modèle de votre Mac depuis un iPhone ou un téléphone Android, par une connexion chiffrée de bout en bout.

Essayez l'IA locale sur votre Mac, gratuitement.

Version 0.11.5 · macOS 13 ou plus récent · sans compte, sans abonnement. Téléchargez, installez un modèle en un clic, et posez votre première question — même hors ligne.