Twoody

Calculateur de LLM local

Le meilleur LLM local pour votre MacBook Air

Du M1 au M5, avec 8 à 32 Go : le modèle le plus fort qui tourne confortablement sur chaque MacBook Air, et à quelle vitesse il écrit.

Votre ordinateur Mémoire Recommandé — tourne confortablement Écrit En un clic dans Twoody

M5 — MacBook Air, MacBook Pro

16 Go Llama 3.1 8B 20–28 tokens/s Qwen3 8B
24 Go gpt-oss-20b 32–47 tokens/s Qwen3 14B
32 Go GLM-4.7-Flash 41–59 tokens/s Qwen3 14B

M4 — MacBook Air, MacBook Pro, Mac mini, iMac

16 Go Llama 3.1 8B 15–22 tokens/s Qwen3 8B
24 Go gpt-oss-20b 25–36 tokens/s Qwen3 14B
32 Go GLM-4.7-Flash 32–46 tokens/s Qwen3 14B

M3 — MacBook Air, MacBook Pro, iMac

8 Go Llama 3.2 3B 31–45 tokens/s Qwen3 4B
16 Go Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 Go gpt-oss-20b 23–32 tokens/s Qwen3 14B

M2 — MacBook Air, MacBook Pro, Mac mini

8 Go Llama 3.2 3B 32–45 tokens/s Qwen3 4B
16 Go Llama 3.1 8B 13–19 tokens/s Qwen3 8B
24 Go gpt-oss-20b 23–33 tokens/s Qwen3 14B

M1 — MacBook Air, MacBook Pro, Mac mini, iMac

8 Go Llama 3.2 3B 20–29 tokens/s Qwen3 4B
16 Go Llama 3.1 8B 8,9–13 tokens/s Qwen3 8B

Des estimations, pas des mesures, calculées à partir des benchmarks publics de llama.cpp. Chiffres revus le 26 septembre 2026.

Un MacBook Air partage sa mémoire entre le processeur et les graphiques. Avec 16 Go, un modèle de 8 milliards de paramètres laisse de la place à vos autres applications ; avec 8 Go, restez vers 4 milliards.

La vitesse suit la bande passante mémoire de la puce : chaque génération écrit plus vite, et le M5 lit un document plusieurs fois plus vite que les puces d'avant.

Sans ventilateur, un MacBook Air ralentit après quelques minutes de travail continu : sans conséquence pour des réponses de longueur normale, davantage pour de longues sessions.

Questions sur les LLM en local

Quel LLM pour un MacBook Air M4 de 16 Go ?

Qwen3 8B ou Qwen3.5 9B : ils tournent confortablement et écrivent environ 15 à 21 tokens par seconde. Twoody installe Qwen3 8B en un clic.

Un MacBook Air de 8 Go peut-il faire tourner un LLM local ?

Oui, un modèle d'environ 4 milliards de paramètres, comme Qwen3 4B, que Twoody installe sur ces Mac. Fermez les applications lourdes pendant ce temps.

Un MacBook Air chauffe-t-il trop avec un LLM local ?

Il ralentit plutôt qu'il ne chauffe : sans ventilateur, il baisse sa vitesse après quelques minutes d'écriture continue. Pour les questions du quotidien, cela ne se remarque pas.

Essayez l'IA locale sur votre Mac, gratuitement.

Version 0.11.5 · macOS 13 ou plus récent · sans compte, sans abonnement. Téléchargez, installez un modèle en un clic, et posez votre première question — même hors ligne.