Chatea con modelos de IA que se ejecutan completamente en tu escritorio. Sin necesidad de internet, sin que los datos salgan de tu dispositivo.
Primeros Pasos
1. Descarga un Modelo
DeskLLM necesita un modelo de lenguaje para funcionar. En el primer inicio, haz clic en el icono de descarga de la barra inferior para abrir el Model Manager.
Recommend tab — Elige un modelo que se ajuste a tu ordenador:
| Categoría | RAM | Mejor para |
|---|---|---|
| Ultra Light | 4 GB+ | Respuestas rápidas, recursos mínimos |
| Light | 8 GB+ | Tareas cotidianas, asistente en segundo plano |
| Standard | 16 GB+ | Chat, escritura, resumen |
| High-End | 32 GB+ | Razonamiento complejo, generación de código |
Haz clic en Download en cualquier tarjeta de modelo. El progreso de la descarga se muestra en tiempo real.
Browse tab — Busca cualquier modelo GGUF en Hugging Face por palabra clave.
2. Empezar a Chatear
- Selecciona un modelo desde el menú desplegable de la barra inferior
- Haz clic en el icono de carga (el modelo se carga automáticamente con el primer mensaje si no está cargado)
- Escribe tu mensaje y pulsa Return para enviar
- La IA responde en tiempo real, token a token
Visión General de la Interfaz
Barra lateral
Actívala con el icono de hamburguesa (arriba a la izquierda). Muestra tus sesiones de chat.
- Haz clic en una sesión para cambiar a ella
- Haz clic derecho para Rename o Delete
- Haz clic en + New Chat para iniciar una conversación nueva
Área de Chat
- Tus mensajes aparecen a la derecha (burbujas de color)
- Las respuestas de la IA aparecen a la izquierda
- Haz clic en el icono de copiar de cualquier mensaje para copiarlo al portapapeles
- Pulsa Shift + Return para una nueva línea sin enviar
Barra Inferior
| Elemento | Descripción |
|---|---|
| Menú de modelos | Selecciona qué modelo usar |
| Icono de descarga | Abre el Model Manager |
| Icono de carga / descarga | Carga o descarga manualmente el modelo actual |
| Etiqueta de estado | Muestra “Generating…” durante la respuesta |
Gestión de Modelos
Ábrela con el icono de descarga de la barra de herramientas.
- Downloaded tab — Lista todos los modelos en tu disco. Elimina los que ya no necesites para liberar espacio.
- Recommend tab — Lista curada de modelos populares con descarga de un solo clic. El espacio en disco se muestra antes de descargar.
- Browse tab — Busca directamente en Hugging Face. Filtra por nombre y explora los archivos GGUF disponibles para cualquier repositorio.
Dónde se Almacenan los Modelos
| OS | Ruta |
|---|---|
| macOS | ~/Library/Application Support/DeskAssist/llm_models/ |
| Windows | %APPDATA%/DeskAssist/llm_models/ |
Ajustes
Accede desde el icono de engranaje (abajo a la izquierda) o desde el menú de la app.
| Ajuste | Descripción | Por defecto |
|---|---|---|
| Temperature | Nivel de creatividad (0.0 = enfocado, 1.0+ = creativo) | 0.7 |
| Max Tokens | Longitud máxima de respuesta | 512 |
| Context Size | Cuánto historial de conversación ve el modelo | 2048 |
| System Prompt | Instrucciones dadas al modelo antes de cada conversación | “You are a helpful assistant.” |
| API Enabled | Inicia un servidor REST API local | On |
| API Port | Número de puerto del servidor API | 8800 |
Cómo Elegir los Ajustes Correctos
- Temperature — Más bajo (0.1–0.3) para respuestas factuales. Más alto (0.7–1.0) para escritura creativa.
- Max Tokens — Aumenta para respuestas más largas. 512 es bueno para la mayoría de las conversaciones.
- Context Size — Valores más altos permiten que el modelo recuerde más de la conversación, pero usan más RAM.
REST API
DeskLLM ejecuta un servidor API local compatible con el formato OpenAI. Otras aplicaciones de tu ordenador pueden usarlo.
Endpoint: http://localhost:8800
Ejemplo (curl)
curl http://localhost:8800/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"messages": [{"role": "user", "content": "Hello!"}],
"stream": true
}'
Ejemplo (Python)
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
model="local",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)
Atajos de Teclado
| Acción | macOS | Windows |
|---|---|---|
| Mostrar / Ocultar ventana | Ctrl + Cmd + F8 | Ctrl + Alt + F8 |
| Enviar mensaje | Return | Return |
| Nueva línea | Shift + Return | Shift + Return |
| Nuevo chat | Cmd + N | Ctrl + N |
Consejos
- Cambia de modelo libremente — Puedes cambiar de modelo en mitad de una conversación en cualquier momento.
- System prompt — Personalízalo para distintos casos de uso: traductor, asistente de programación, ayudante de escritura, etc.
- Múltiples sesiones — Mantén conversaciones separadas para distintos temas. La barra lateral facilita el cambio.
- Uso sin conexión — Una vez descargado un modelo, DeskLLM funciona completamente sin conexión.
- Integración con API — Usa la API integrada para conectar DeskLLM con otras herramientas, scripts o aplicaciones de tu máquina.
Solución de Problemas
| Problema | Solución |
|---|---|
| El modelo no carga | Comprueba la RAM disponible. Una cuantización menor (Q4_K_M) usa menos memoria. |
| Respuestas lentas | Prueba con un modelo más pequeño. Cierra otras apps que usen mucha memoria. |
| Salida incoherente | Baja la temperatura. Prueba con un modelo distinto. |
| La descarga falla | Comprueba la conexión a internet. Inténtalo de nuevo — las descargas se reanudan automáticamente. |
| La app no inicia | Elimina el archivo de ajustes y reinicia. |
Privacidad
- Todo el procesamiento de IA ocurre localmente en tu ordenador
- No se envían datos a ningún servidor externo
- El historial de chat se almacena solo en tu disco local
- Los modelos se descargan desde Hugging Face (el único acceso a la red)