LLM local en Linux
Ejecuta un LLM local en Linux
Un gran modelo de lenguaje puede funcionar por completo en tu equipo con Linux: en privado, sin conexión y gratis. Qué necesitas, qué modelo elegir y la forma más sencilla de empezar, con una AppImage o un paquete .deb.
Por qué ejecutar un LLM en tu equipo
El modelo responde y lee tus archivos en la propia máquina. Funciona sin internet. No hay suscripción, ni límites de uso, ni necesidad de cuenta. La contrapartida: un modelo que cabe en un ordenador personal es más pequeño que los mayores modelos en línea. Es excelente para redactar, resumir y trabajar con tus documentos, pero no tanto para los razonamientos más difíciles.
Qué necesitas
Un PC x86_64 con Linux. En el procesador, decide la memoria del ordenador (RAM): 8 GB para unos 4000 millones de parámetros, 16 GB para 8000 millones, 24 GB para 14 000 millones. La velocidad de la memoria cuenta: con DDR5 escribe más rápido que con DDR4. Una tarjeta gráfica NVIDIA o AMD acelera mucho, con las herramientas que la usan en Linux.
Qué modelo elegir
Qwen3.5 escribe bien en muchos idiomas y en todos sus tamaños; Llama, Gemma, Mistral y gpt-oss son buenas alternativas. En el procesador, quédate con los modelos pequeños, de unos 4000 a 9000 millones de parámetros: uno más grande cabe en la memoria, pero escribe demasiado despacio para usarlo con comodidad.
Tres formas de hacerlo
- Twoody: la misma app que en el Mac y en Windows. Te propone el modelo adecuado para tu equipo y lo instala con un clic, lee tus carpetas de documentos y los cita. Una AppImage o un paquete .deb, probados en Ubuntu 24.04; el modelo funciona en el procesador.
- LM Studio: una app para explorar miles de modelos y sus ajustes. Una AppImage, para Ubuntu 20.04 o posterior, en x64 (con AVX2) y ARM64.
- Ollama: un motor que se usa desde el terminal o su API, y que se instala con un solo comando. Usa las tarjetas NVIDIA (CUDA) y AMD (ROCm).
Qué cambia respecto al Mac y a Windows
Es la misma app, con las mismas conversaciones y los mismos documentos. En Linux, el modelo funciona en el procesador: ahí Twoody no usa la tarjeta gráfica. Por ahora, las actualizaciones son manuales: descargas tú mismo la nueva versión. Y tres cosas son exclusivas del Mac: la lectura de PDF escaneados, Contactos y Calendario, y el dictado con el reconocimiento de voz de macOS; en Linux, tu voz se transcribe en la máquina con whisper.cpp, incluido en la app.
Con Twoody, en tres pasos
-
1
Únete a la lista de espera: Twoody está en beta privada, en Linux igual que en el Mac y en Windows, y te escribiremos cuando esté abierto para ti.
-
2
Instala el modelo que te propone para tu equipo: 2,8 o 5,8 GB, con un clic.
-
3
Haz tu primera pregunta, y apaga el Wi-Fi si quieres.
Preguntas frecuentes
¿Es gratis ejecutar un LLM local en Linux?
Sí: los modelos abiertos se descargan gratis, y Twoody, LM Studio y Ollama son gratuitos. Lo único que consumes es la memoria de tu equipo y la electricidad.
¿Twoody usa la tarjeta gráfica en Linux?
No: en Linux, Twoody ejecuta el modelo en el procesador. Para usar una tarjeta NVIDIA o AMD, Ollama y LM Studio lo hacen en Linux, y Twoody puede usar los modelos que ejecutan.
¿En qué distribuciones funciona Twoody?
Twoody está probado en Ubuntu 24.04 (x86_64). La AppImage funciona en la mayoría de las distribuciones; el paquete .deb instala Twoody en Debian, Ubuntu y sus derivadas.
¿Cuánta memoria necesito para ejecutar un LLM en Linux?
8 GB para un modelo pequeño como Qwen3.5 4B, 16 GB para Qwen3.5 9B. La calculadora muestra qué ejecuta un PC sin tarjeta gráfica, con memoria DDR4 o DDR5, y a qué velocidad.
¿Puedo usar Twoody en Linux hoy?
En la beta privada, sí: Twoody funciona en Linux (x86_64), igual que en el Mac y en Windows. Sus descargas son para las personas de la beta: deja tu correo para unirte a la lista de espera.
Twoody está en beta privada.
En Mac, Windows y Linux, gratis, sin cuenta ni suscripción, y en iPhone y Android, con Twoody en tu ordenador. Deja tu correo: te escribiremos cuando Twoody se abra para ti.