DeskLLM - Guida

Chatta con modelli di IA che girano interamente sul tuo desktop. Nessuna connessione internet richiesta, nessun dato lascia il tuo dispositivo.


Per Iniziare

1. Scarica un Modello

DeskLLM ha bisogno di un modello linguistico per funzionare. Al primo avvio, fai clic sull’icona di download nella barra degli strumenti in basso per aprire il Model Manager.

Recommend tab — Scegli un modello adatto al tuo computer:

CategoriaRAMIdeale per
Ultra Light4 GB+Risposte rapide, risorse minime
Light8 GB+Attività quotidiane, assistente in background
Standard16 GB+Chat, scrittura, riassunto
High-End32 GB+Ragionamento complesso, generazione di codice

Fai clic su Download su qualsiasi scheda di modello. Il progresso del download è mostrato in tempo reale.

Browse tab — Cerca su Hugging Face qualsiasi modello GGUF tramite parola chiave.

2. Iniziare a Chattare

  1. Seleziona un modello dal menu a tendina nella barra in basso
  2. Fai clic sull’icona di caricamento (il modello si carica automaticamente al primo messaggio se non è caricato)
  3. Digita il tuo messaggio e premi Return per inviare
  4. L’IA risponde in tempo reale, token per token

Panoramica dell’Interfaccia

Barra Laterale

Attivala con l’icona hamburger (in alto a sinistra). Mostra le tue sessioni di chat.

  • Fai clic su una sessione per passarvi
  • Fai clic destro per Rename o Delete
  • Fai clic su + New Chat per avviare una nuova conversazione

Area Chat

  • I tuoi messaggi appaiono a destra (fumetti colorati)
  • Le risposte dell’IA appaiono a sinistra
  • Fai clic sull’icona di copia in qualsiasi messaggio per copiarlo negli appunti
  • Premi Shift + Return per andare a capo senza inviare

Barra degli Strumenti in Basso

ElementoDescrizione
Menu a tendina dei modelliSeleziona quale modello usare
Icona di downloadApre il Model Manager
Icona carica / scaricaCarica o scarica manualmente il modello attuale
Etichetta di statoMostra “Generating…” durante la risposta

Gestione Modelli

Apri con l’icona di download nella barra degli strumenti.

  • Downloaded tab — Elenca tutti i modelli sul tuo disco. Elimina i modelli che non ti servono più per liberare spazio.
  • Recommend tab — Elenco curato di modelli popolari con download in un clic. Lo spazio su disco è mostrato prima del download.
  • Browse tab — Cerca direttamente su Hugging Face. Filtra per nome e sfoglia i file GGUF disponibili per qualsiasi repository.

Dove sono Archiviati i Modelli

OSPercorso
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Impostazioni

Accedi tramite l’icona dell’ingranaggio (in basso a sinistra) o dal menu dell’app.

ImpostazioneDescrizionePredefinito
TemperatureLivello di creatività (0.0 = focalizzato, 1.0+ = creativo)0.7
Max TokensLunghezza massima della risposta512
Context SizeQuanta cronologia di conversazione vede il modello2048
System PromptIstruzioni date al modello prima di ogni conversazione“You are a helpful assistant.”
API EnabledAvvia un server REST API localeOn
API PortNumero di porta del server API8800

Scegliere le Impostazioni Giuste

  • Temperature — Più basso (0.1–0.3) per risposte fattuali. Più alto (0.7–1.0) per scrittura creativa.
  • Max Tokens — Aumenta per risposte più lunghe. 512 va bene per la maggior parte delle conversazioni.
  • Context Size — Valori più alti permettono al modello di ricordare più della conversazione, ma usano più RAM.

REST API

DeskLLM esegue un server API locale compatibile con il formato OpenAI. Altre app sul tuo computer possono usarlo.

Endpoint: http://localhost:8800

Esempio (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Esempio (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Scorciatoie da Tastiera

AzionemacOSWindows
Mostra / Nascondi finestraCtrl + Cmd + F8Ctrl + Alt + F8
Invia messaggioReturnReturn
Nuova rigaShift + ReturnShift + Return
Nuova chatCmd + NCtrl + N

Consigli

  • Cambia modello liberamente — Puoi cambiare modello a metà conversazione in qualsiasi momento.
  • System prompt — Personalizzalo per diversi casi d’uso: traduttore, assistente di programmazione, aiuto alla scrittura, ecc.
  • Sessioni multiple — Mantieni conversazioni separate per argomenti diversi. La barra laterale rende facile passare da una all’altra.
  • Uso offline — Una volta scaricato un modello, DeskLLM funziona completamente offline.
  • Integrazione API — Usa l’API integrata per collegare DeskLLM ad altri strumenti, script o app sulla tua macchina.

Risoluzione dei Problemi

ProblemaSoluzione
Il modello non si caricaControlla la RAM disponibile. Una quantizzazione più piccola (Q4_K_M) usa meno memoria.
Risposte lenteProva un modello più piccolo. Chiudi altre app che consumano molta memoria.
Output incomprensibileAbbassa la temperatura. Prova un modello diverso.
Il download fallisceControlla la connessione internet. Riprova — i download riprendono automaticamente.
L’app non si avviaElimina il file delle impostazioni e riavvia.

Privacy

  • Tutta l’elaborazione di IA avviene localmente sul tuo computer
  • Nessun dato viene inviato a server esterni
  • La cronologia chat è memorizzata solo sul tuo disco locale
  • I modelli vengono scaricati da Hugging Face (l’unico accesso alla rete)