Calculateur de LLM local
Le meilleur LLM local pour votre Mac mini
Du M1 au M6, et les versions Pro : le modèle le plus fort qui tourne confortablement sur chaque Mac mini, et à quelle vitesse il écrit.
| Votre ordinateur | Mémoire | Recommandé — tourne confortablement | Écrit | En un clic dans Twoody |
|---|---|---|---|---|
M5 Pro — MacBook Pro, Mac mini |
24 Go | gpt-oss-20b | 68–97 tokens/s | Qwen3 14B |
| 48 Go | GLM-4.7-Flash | 92–132 tokens/s | Qwen3 14B | |
| 64 Go | GLM-4.7-Flash | 92–132 tokens/s | Qwen3 14B | |
M6 — Mac mini |
16 Go | Llama 3.1 8B | 17–31 tokens/s | Qwen3 8B |
| 24 Go | gpt-oss-20b | 30–54 tokens/s | Qwen3 14B | |
| 32 Go | GLM-4.7-Flash | 36–64 tokens/s | Qwen3 14B | |
M4 Pro — MacBook Pro, Mac mini |
24 Go | gpt-oss-20b | 52–74 tokens/s | Qwen3 14B |
| 48 Go | GLM-4.7-Flash | 56–81 tokens/s | Qwen3 14B | |
| 64 Go | GLM-4.7-Flash | 56–81 tokens/s | Qwen3 14B | |
M4 — MacBook Air, MacBook Pro, Mac mini, iMac |
16 Go | Llama 3.1 8B | 15–22 tokens/s | Qwen3 8B |
| 24 Go | gpt-oss-20b | 25–36 tokens/s | Qwen3 14B | |
| 32 Go | GLM-4.7-Flash | 32–46 tokens/s | Qwen3 14B | |
M2 Pro — MacBook Pro, Mac mini |
16 Go | Llama 3.1 8B | 24–35 tokens/s | Qwen3 8B |
| 32 Go | GLM-4.7-Flash | 45–65 tokens/s | Qwen3 14B | |
M2 — MacBook Air, MacBook Pro, Mac mini |
8 Go | Llama 3.2 3B | 32–45 tokens/s | Qwen3 4B |
| 16 Go | Llama 3.1 8B | 13–19 tokens/s | Qwen3 8B | |
| 24 Go | gpt-oss-20b | 23–33 tokens/s | Qwen3 14B | |
M1 — MacBook Air, MacBook Pro, Mac mini, iMac |
8 Go | Llama 3.2 3B | 20–29 tokens/s | Qwen3 4B |
| 16 Go | Llama 3.1 8B | 8,9–13 tokens/s | Qwen3 8B |
Des estimations, pas des mesures, calculées à partir des benchmarks publics de llama.cpp. Chiffres revus le 26 septembre 2026.
Le Mac mini est la façon la moins chère de faire tourner un LLM local sur Mac : un modèle de 8 milliards de paramètres avec 16 Go, un mélange d'experts avec 48 Go et une puce Pro.
Silencieux et toujours allumé, un Mac mini est aussi le genre d'ordinateur que les apps pour téléphone en préparation sont faites pour utiliser à distance.
Les versions Pro lisent leur mémoire plus de deux fois plus vite que les puces de base : de plus grands modèles, et des réponses plus rapides.
Questions sur les LLM en local
Quel LLM pour un Mac mini M4 de 16 Go ?
Qwen3 8B, Qwen3.5 9B ou Llama 3.1 8B tournent confortablement, à environ 15 à 21 tokens par seconde. Twoody installe Qwen3 8B en un clic.
Un Mac mini M4 Pro vaut-il le coup pour l'IA locale ?
Avec 48 ou 64 Go, oui : il fait tourner des mélanges d'experts comme Qwen3 30B-A3B ou gpt-oss-20b à plusieurs dizaines de tokens par seconde.
Un Mac mini peut-il servir un LLM local à d'autres appareils ?
C'est ce que feront les apps pour téléphone en préparation : utiliser le modèle de votre Mac depuis un iPhone ou un téléphone Android, par une connexion chiffrée de bout en bout.
Le meilleur LLM local, par ordinateur
Essayez l'IA locale sur votre Mac, gratuitement.
Version 0.11.5 · macOS 13 ou plus récent · sans compte, sans abonnement. Téléchargez, installez un modèle en un clic, et posez votre première question — même hors ligne.