Twoody

LLM locale su Linux

Esegui un LLM in locale su Linux

Un modello linguistico di grandi dimensioni può girare interamente sulla tua macchina Linux: in privato, offline e gratis. Cosa ti serve, quale modello scegliere e il modo più semplice per iniziare, con un'AppImage o un pacchetto .deb.

Perché eseguire un LLM sulla tua macchina

Il modello ti risponde e legge i tuoi file sulla macchina. Funziona senza internet. Senza abbonamento, senza limiti di utilizzo e senza bisogno di un account. Il compromesso: un modello che sta su un computer personale è più piccolo dei più grandi modelli online — eccellente per scrivere, riassumere e lavorare sui tuoi documenti, meno per i ragionamenti più difficili.

Cosa ti serve

Un PC x86_64 con Linux. Sul processore decide la memoria del computer (RAM): 8 GB per circa 4 miliardi di parametri, 16 GB per 8 miliardi, 24 GB per 14 miliardi. Conta la velocità della memoria: con la DDR5 si scrive più in fretta che con la DDR4. Una scheda grafica NVIDIA o AMD accelera molto, con gli strumenti che la usano su Linux.

Quale modello scegliere

Qwen3.5 scrive bene in molte lingue, a ogni dimensione; Llama, Gemma, Mistral e gpt-oss sono buone alternative. Sul processore, resta sui modelli piccoli, da circa 4 a 9 miliardi di parametri: uno più grande entra in memoria, ma scrive troppo lentamente per lavorare comodi.

Tre modi per farlo

  • Twoody — la stessa app che su Mac e Windows: ti propone il modello adatto alla tua macchina e lo installa con un clic, legge le tue cartelle di documenti e le cita. Un'AppImage o un pacchetto .deb, testato su Ubuntu 24.04; il modello gira sul processore.
  • LM Studio — un'app per esplorare migliaia di modelli e le loro impostazioni. Un'AppImage, per Ubuntu 20.04 o successivo, su x64 (con AVX2) e ARM64.
  • Ollama — un motore da usare dal terminale o tramite la sua API, che si installa con un solo comando. Usa le schede NVIDIA (CUDA) e AMD (ROCm).

Cosa cambia rispetto a Mac e Windows

È la stessa app, con le stesse conversazioni e gli stessi documenti. Su Linux, il modello gira sul processore: lì Twoody non usa la scheda grafica. Per ora gli aggiornamenti sono manuali: la nuova versione la scarichi tu. E tre cose ci sono solo sul Mac: la lettura dei PDF scansionati, Contatti e Calendario, e la dettatura con il riconoscimento vocale di macOS — su Linux, la tua voce viene trascritta sulla macchina da whisper.cpp, incluso nell'app.

Con Twoody, in tre passaggi

  1. 1

    Iscriviti alla lista d'attesa: Twoody è in beta privata, su Linux come sul Mac e su Windows, e ti scriveremo quando sarà aperto per te.

  2. 2

    Installa il modello che ti propone per la tua macchina: 2,8 o 5,8 GB, con un clic.

  3. 3

    Fai la tua prima domanda — e spegni il Wi-Fi, se vuoi.

Domande frequenti

Eseguire un LLM in locale su Linux è gratis?

Sì: i modelli aperti si scaricano gratis, e Twoody, LM Studio e Ollama sono gratuiti. L'unico costo è la memoria della tua macchina e l'elettricità.

Twoody usa la scheda grafica su Linux?

No: su Linux, Twoody esegue il modello sul processore. Per usare una scheda NVIDIA o AMD su Linux ci sono Ollama e LM Studio, e Twoody può usare i modelli che fanno girare.

Su quali distribuzioni funziona Twoody?

Twoody è testato su Ubuntu 24.04 (x86_64). L'AppImage funziona sulla maggior parte delle distribuzioni; il pacchetto .deb installa Twoody su Debian, Ubuntu e derivate.

Quanta memoria serve per eseguire un LLM su Linux?

8 GB per un modello piccolo come Qwen3.5 4B, 16 GB per Qwen3.5 9B. Il calcolatore mostra cosa fa girare un PC senza scheda grafica, con memoria DDR4 o DDR5, e a che velocità.

Posso usare Twoody su Linux oggi?

Nella beta privata, sì: Twoody funziona su Linux (x86_64), come sul Mac e su Windows. I download sono riservati a chi partecipa alla beta: lascia la tua email per entrare nella lista d'attesa.

Twoody è in beta privata.

Su Mac, Windows e Linux, gratis, senza account né abbonamento, e su iPhone e Android, con Twoody sul tuo computer. Lascia la tua email: ti scriveremo quando Twoody sarà aperto per te.