DeskLLM - Guía

Chatea con modelos de IA que se ejecutan completamente en tu escritorio. Sin necesidad de internet, sin que los datos salgan de tu dispositivo.


Primeros Pasos

1. Descarga un Modelo

DeskLLM necesita un modelo de lenguaje para funcionar. En el primer inicio, haz clic en el icono de descarga de la barra inferior para abrir el Model Manager.

Recommend tab — Elige un modelo que se ajuste a tu ordenador:

CategoríaRAMMejor para
Ultra Light4 GB+Respuestas rápidas, recursos mínimos
Light8 GB+Tareas cotidianas, asistente en segundo plano
Standard16 GB+Chat, escritura, resumen
High-End32 GB+Razonamiento complejo, generación de código

Haz clic en Download en cualquier tarjeta de modelo. El progreso de la descarga se muestra en tiempo real.

Browse tab — Busca cualquier modelo GGUF en Hugging Face por palabra clave.

2. Empezar a Chatear

  1. Selecciona un modelo desde el menú desplegable de la barra inferior
  2. Haz clic en el icono de carga (el modelo se carga automáticamente con el primer mensaje si no está cargado)
  3. Escribe tu mensaje y pulsa Return para enviar
  4. La IA responde en tiempo real, token a token

Visión General de la Interfaz

Barra lateral

Actívala con el icono de hamburguesa (arriba a la izquierda). Muestra tus sesiones de chat.

  • Haz clic en una sesión para cambiar a ella
  • Haz clic derecho para Rename o Delete
  • Haz clic en + New Chat para iniciar una conversación nueva

Área de Chat

  • Tus mensajes aparecen a la derecha (burbujas de color)
  • Las respuestas de la IA aparecen a la izquierda
  • Haz clic en el icono de copiar de cualquier mensaje para copiarlo al portapapeles
  • Pulsa Shift + Return para una nueva línea sin enviar

Barra Inferior

ElementoDescripción
Menú de modelosSelecciona qué modelo usar
Icono de descargaAbre el Model Manager
Icono de carga / descargaCarga o descarga manualmente el modelo actual
Etiqueta de estadoMuestra “Generating…” durante la respuesta

Gestión de Modelos

Ábrela con el icono de descarga de la barra de herramientas.

  • Downloaded tab — Lista todos los modelos en tu disco. Elimina los que ya no necesites para liberar espacio.
  • Recommend tab — Lista curada de modelos populares con descarga de un solo clic. El espacio en disco se muestra antes de descargar.
  • Browse tab — Busca directamente en Hugging Face. Filtra por nombre y explora los archivos GGUF disponibles para cualquier repositorio.

Dónde se Almacenan los Modelos

OSRuta
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Ajustes

Accede desde el icono de engranaje (abajo a la izquierda) o desde el menú de la app.

AjusteDescripciónPor defecto
TemperatureNivel de creatividad (0.0 = enfocado, 1.0+ = creativo)0.7
Max TokensLongitud máxima de respuesta512
Context SizeCuánto historial de conversación ve el modelo2048
System PromptInstrucciones dadas al modelo antes de cada conversación“You are a helpful assistant.”
API EnabledInicia un servidor REST API localOn
API PortNúmero de puerto del servidor API8800

Cómo Elegir los Ajustes Correctos

  • Temperature — Más bajo (0.1–0.3) para respuestas factuales. Más alto (0.7–1.0) para escritura creativa.
  • Max Tokens — Aumenta para respuestas más largas. 512 es bueno para la mayoría de las conversaciones.
  • Context Size — Valores más altos permiten que el modelo recuerde más de la conversación, pero usan más RAM.

REST API

DeskLLM ejecuta un servidor API local compatible con el formato OpenAI. Otras aplicaciones de tu ordenador pueden usarlo.

Endpoint: http://localhost:8800

Ejemplo (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Ejemplo (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Atajos de Teclado

AcciónmacOSWindows
Mostrar / Ocultar ventanaCtrl + Cmd + F8Ctrl + Alt + F8
Enviar mensajeReturnReturn
Nueva líneaShift + ReturnShift + Return
Nuevo chatCmd + NCtrl + N

Consejos

  • Cambia de modelo libremente — Puedes cambiar de modelo en mitad de una conversación en cualquier momento.
  • System prompt — Personalízalo para distintos casos de uso: traductor, asistente de programación, ayudante de escritura, etc.
  • Múltiples sesiones — Mantén conversaciones separadas para distintos temas. La barra lateral facilita el cambio.
  • Uso sin conexión — Una vez descargado un modelo, DeskLLM funciona completamente sin conexión.
  • Integración con API — Usa la API integrada para conectar DeskLLM con otras herramientas, scripts o aplicaciones de tu máquina.

Solución de Problemas

ProblemaSolución
El modelo no cargaComprueba la RAM disponible. Una cuantización menor (Q4_K_M) usa menos memoria.
Respuestas lentasPrueba con un modelo más pequeño. Cierra otras apps que usen mucha memoria.
Salida incoherenteBaja la temperatura. Prueba con un modelo distinto.
La descarga fallaComprueba la conexión a internet. Inténtalo de nuevo — las descargas se reanudan automáticamente.
La app no iniciaElimina el archivo de ajustes y reinicia.

Privacidad

  • Todo el procesamiento de IA ocurre localmente en tu ordenador
  • No se envían datos a ningún servidor externo
  • El historial de chat se almacena solo en tu disco local
  • Los modelos se descargan desde Hugging Face (el único acceso a la red)