Calculateur de LLM local
Un LLM local sur votre Mac Intel
Twoody tourne sur les Mac Intel sous macOS 13 ou plus récent. Le modèle tourne sur le processeur : les petits modèles fonctionnent, lentement.
| Votre ordinateur | Mémoire | Recommandé — tourne confortablement | Écrit | En un clic dans Twoody |
|---|---|---|---|---|
MacBook Air, MacBook Pro 13″ Intel (2018–2020) |
8 Go | Qwen3 0.6B | 22–65 tokens/s | Qwen3 4B |
| 16 Go | Llama 3.1 8B | 3,4–6,1 tokens/s | Qwen3 8B | |
| 32 Go | GLM-4.7-Flash | 7,9–14 tokens/s | Qwen3 14B | |
MacBook Pro 15″, 16″ Intel (2018–2019) |
16 Go | Llama 3.1 8B | 3–5,4 tokens/s | Qwen3 8B |
| 32 Go | GLM-4.7-Flash | 7,1–13 tokens/s | Qwen3 14B | |
| 64 Go | Qwen3-Next 80B-A3B | 6–11 tokens/s | Qwen3 14B | |
iMac, Mac mini Intel (2017–2020) |
8 Go | Qwen3 0.6B | 21–62 tokens/s | Qwen3 4B |
| 16 Go | Llama 3.1 8B | 3,2–5,7 tokens/s | Qwen3 8B | |
| 32 Go | GLM-4.7-Flash | 7,5–13 tokens/s | Qwen3 14B | |
| 64 Go | Qwen3-Next 80B-A3B | 6,4–11 tokens/s | Qwen3 14B | |
iMac Pro, Mac Pro (2017–2019) |
32 Go | GLM-4.7-Flash | 17–30 tokens/s | Qwen3 14B |
| 64 Go | Qwen3-Next 80B-A3B | 14–25 tokens/s | Qwen3 14B | |
| 128 Go | Qwen3-Next 80B-A3B | 14–25 tokens/s | Qwen3 14B |
Des estimations, pas des mesures, calculées à partir des benchmarks publics de llama.cpp. Chiffres revus le 26 septembre 2026.
Sur un Mac Intel, llama.cpp utilise le processeur, pas les graphiques : un modèle d'environ 4 milliards de paramètres écrit quelques mots par seconde, assez pour des réponses courtes.
Twoody installe le Qwen3 qui convient à la mémoire ; sur ces Mac, le 4B est celui qui répond le plus vite.
LM Studio demande un Mac Apple Silicon et macOS 14, et Ollama macOS 14 : sur un Mac Intel ou sous macOS 13, Twoody installe et fait tourner un modèle en un clic.
Questions sur les LLM en local
Un LLM local fonctionne-t-il sur un Mac Intel ?
Oui, sur le processeur : un modèle de 4 milliards de paramètres écrit quelques tokens par seconde, et la lecture d'un long document prend plusieurs minutes.
Quelle app d'IA locale fonctionne sous macOS 13 ?
Twoody tourne sous macOS 13 (Ventura) et plus récent, sur Apple Silicon comme sur Intel ; il installe un modèle en un clic.
Quel modèle pour un Mac Intel ?
Les plus petits qui restent utiles : Qwen3 4B ou Qwen3.5 4B. De plus grands tiennent en mémoire mais écrivent trop lentement pour être confortables.
Le meilleur LLM local, par ordinateur
Essayez l'IA locale sur votre Mac, gratuitement.
Version 0.11.5 · macOS 13 ou plus récent · sans compte, sans abonnement. Téléchargez, installez un modèle en un clic, et posez votre première question — même hors ligne.