Calculateur de LLM local
Le meilleur LLM local pour votre MacBook Air
Du M1 au M5, avec 8 à 32 Go : le modèle le plus fort qui tourne confortablement sur chaque MacBook Air, et à quelle vitesse il écrit.
| Votre ordinateur | Mémoire | Recommandé — tourne confortablement | Écrit | En un clic dans Twoody |
|---|---|---|---|---|
M5 — MacBook Air, MacBook Pro |
16 Go | Llama 3.1 8B | 20–28 tokens/s | Qwen3 8B |
| 24 Go | gpt-oss-20b | 32–47 tokens/s | Qwen3 14B | |
| 32 Go | GLM-4.7-Flash | 41–59 tokens/s | Qwen3 14B | |
M4 — MacBook Air, MacBook Pro, Mac mini, iMac |
16 Go | Llama 3.1 8B | 15–22 tokens/s | Qwen3 8B |
| 24 Go | gpt-oss-20b | 25–36 tokens/s | Qwen3 14B | |
| 32 Go | GLM-4.7-Flash | 32–46 tokens/s | Qwen3 14B | |
M3 — MacBook Air, MacBook Pro, iMac |
8 Go | Llama 3.2 3B | 31–45 tokens/s | Qwen3 4B |
| 16 Go | Llama 3.1 8B | 13–19 tokens/s | Qwen3 8B | |
| 24 Go | gpt-oss-20b | 23–32 tokens/s | Qwen3 14B | |
M2 — MacBook Air, MacBook Pro, Mac mini |
8 Go | Llama 3.2 3B | 32–45 tokens/s | Qwen3 4B |
| 16 Go | Llama 3.1 8B | 13–19 tokens/s | Qwen3 8B | |
| 24 Go | gpt-oss-20b | 23–33 tokens/s | Qwen3 14B | |
M1 — MacBook Air, MacBook Pro, Mac mini, iMac |
8 Go | Llama 3.2 3B | 20–29 tokens/s | Qwen3 4B |
| 16 Go | Llama 3.1 8B | 8,9–13 tokens/s | Qwen3 8B |
Des estimations, pas des mesures, calculées à partir des benchmarks publics de llama.cpp. Chiffres revus le 26 septembre 2026.
Un MacBook Air partage sa mémoire entre le processeur et les graphiques. Avec 16 Go, un modèle de 8 milliards de paramètres laisse de la place à vos autres applications ; avec 8 Go, restez vers 4 milliards.
La vitesse suit la bande passante mémoire de la puce : chaque génération écrit plus vite, et le M5 lit un document plusieurs fois plus vite que les puces d'avant.
Sans ventilateur, un MacBook Air ralentit après quelques minutes de travail continu : sans conséquence pour des réponses de longueur normale, davantage pour de longues sessions.
Questions sur les LLM en local
Quel LLM pour un MacBook Air M4 de 16 Go ?
Qwen3 8B ou Qwen3.5 9B : ils tournent confortablement et écrivent environ 15 à 21 tokens par seconde. Twoody installe Qwen3 8B en un clic.
Un MacBook Air de 8 Go peut-il faire tourner un LLM local ?
Oui, un modèle d'environ 4 milliards de paramètres, comme Qwen3 4B, que Twoody installe sur ces Mac. Fermez les applications lourdes pendant ce temps.
Un MacBook Air chauffe-t-il trop avec un LLM local ?
Il ralentit plutôt qu'il ne chauffe : sans ventilateur, il baisse sa vitesse après quelques minutes d'écriture continue. Pour les questions du quotidien, cela ne se remarque pas.
Le meilleur LLM local, par ordinateur
Essayez l'IA locale sur votre Mac, gratuitement.
Version 0.11.5 · macOS 13 ou plus récent · sans compte, sans abonnement. Téléchargez, installez un modèle en un clic, et posez votre première question — même hors ligne.