LLM locale su Linux
Esegui un LLM in locale su Linux
Un modello linguistico di grandi dimensioni può girare interamente sulla tua macchina Linux: in privato, offline e gratis. Cosa ti serve, quale modello scegliere e il modo più semplice per iniziare, con un'AppImage o un pacchetto .deb.
Perché eseguire un LLM sulla tua macchina
Il modello ti risponde e legge i tuoi file sulla macchina. Funziona senza internet. Senza abbonamento, senza limiti di utilizzo e senza bisogno di un account. Il compromesso: un modello che sta su un computer personale è più piccolo dei più grandi modelli online — eccellente per scrivere, riassumere e lavorare sui tuoi documenti, meno per i ragionamenti più difficili.
Cosa ti serve
Un PC x86_64 con Linux. Sul processore decide la memoria del computer (RAM): 8 GB per circa 4 miliardi di parametri, 16 GB per 8 miliardi, 24 GB per 14 miliardi. Conta la velocità della memoria: con la DDR5 si scrive più in fretta che con la DDR4. Una scheda grafica NVIDIA o AMD accelera molto, con gli strumenti che la usano su Linux.
Quale modello scegliere
Qwen3.5 scrive bene in molte lingue, a ogni dimensione; Llama, Gemma, Mistral e gpt-oss sono buone alternative. Sul processore, resta sui modelli piccoli, da circa 4 a 9 miliardi di parametri: uno più grande entra in memoria, ma scrive troppo lentamente per lavorare comodi.
Tre modi per farlo
- Twoody — la stessa app che su Mac e Windows: ti propone il modello adatto alla tua macchina e lo installa con un clic, legge le tue cartelle di documenti e le cita. Un'AppImage o un pacchetto .deb, testato su Ubuntu 24.04; il modello gira sul processore.
- LM Studio — un'app per esplorare migliaia di modelli e le loro impostazioni. Un'AppImage, per Ubuntu 20.04 o successivo, su x64 (con AVX2) e ARM64.
- Ollama — un motore da usare dal terminale o tramite la sua API, che si installa con un solo comando. Usa le schede NVIDIA (CUDA) e AMD (ROCm).
Cosa cambia rispetto a Mac e Windows
È la stessa app, con le stesse conversazioni e gli stessi documenti. Su Linux, il modello gira sul processore: lì Twoody non usa la scheda grafica. Per ora gli aggiornamenti sono manuali: la nuova versione la scarichi tu. E tre cose ci sono solo sul Mac: la lettura dei PDF scansionati, Contatti e Calendario, e la dettatura con il riconoscimento vocale di macOS — su Linux, la tua voce viene trascritta sulla macchina da whisper.cpp, incluso nell'app.
Con Twoody, in tre passaggi
-
1
Iscriviti alla lista d'attesa: Twoody è in beta privata, su Linux come sul Mac e su Windows, e ti scriveremo quando sarà aperto per te.
-
2
Installa il modello che ti propone per la tua macchina: 2,8 o 5,8 GB, con un clic.
-
3
Fai la tua prima domanda — e spegni il Wi-Fi, se vuoi.
Domande frequenti
Eseguire un LLM in locale su Linux è gratis?
Sì: i modelli aperti si scaricano gratis, e Twoody, LM Studio e Ollama sono gratuiti. L'unico costo è la memoria della tua macchina e l'elettricità.
Twoody usa la scheda grafica su Linux?
No: su Linux, Twoody esegue il modello sul processore. Per usare una scheda NVIDIA o AMD su Linux ci sono Ollama e LM Studio, e Twoody può usare i modelli che fanno girare.
Su quali distribuzioni funziona Twoody?
Twoody è testato su Ubuntu 24.04 (x86_64). L'AppImage funziona sulla maggior parte delle distribuzioni; il pacchetto .deb installa Twoody su Debian, Ubuntu e derivate.
Quanta memoria serve per eseguire un LLM su Linux?
8 GB per un modello piccolo come Qwen3.5 4B, 16 GB per Qwen3.5 9B. Il calcolatore mostra cosa fa girare un PC senza scheda grafica, con memoria DDR4 o DDR5, e a che velocità.
Posso usare Twoody su Linux oggi?
Nella beta privata, sì: Twoody funziona su Linux (x86_64), come sul Mac e su Windows. I download sono riservati a chi partecipa alla beta: lascia la tua email per entrare nella lista d'attesa.
Twoody è in beta privata.
Su Mac, Windows e Linux, gratis, senza account né abbonamento, e su iPhone e Android, con Twoody sul tuo computer. Lascia la tua email: ti scriveremo quando Twoody sarà aperto per te.