DeskLLM - Guide

Chatta med AI-modeller som körs helt på din dator. Inget internet behövs, ingen data lämnar din enhet.


Komma igång

1. Ladda ner en modell

DeskLLM behöver en språkmodell för att fungera. Vid första starten klickar du på nedladdningsikonen i det nedre verktygsfältet för att öppna Model Manager.

Recommend tab — Välj en modell som passar din dator:

KategoriRAMBäst för
Ultra Light4 GB+Snabba svar, minimala resurser
Light8 GB+Vardagliga uppgifter, bakgrundsassistent
Standard16 GB+Chatt, skrivande, sammanfattning
High-End32 GB+Komplext resonemang, kodgenerering

Klicka på Download på valfritt modellkort. Nedladdningens framsteg visas i realtid.

Browse tab — Sök på Hugging Face efter valfri GGUF-modell med nyckelord.

2. Börja chatta

  1. Välj en modell från rullgardinsmenyn i det nedre verktygsfältet
  2. Klicka på laddningsikonen (modellen laddas automatiskt vid första meddelandet om den inte är laddad)
  3. Skriv ditt meddelande och tryck på Return för att skicka
  4. AI:n svarar i realtid, token för token

Översikt över gränssnittet

Sidofält

Växla med hamburgerikonen (uppe till vänster). Visar dina chattsessioner.

  • Klicka på en session för att växla till den
  • Högerklicka för att Rename eller Delete
  • Klicka på + New Chat för att starta en ny konversation

Chattområde

  • Dina meddelanden visas till höger (färgade bubblor)
  • AI-svar visas till vänster
  • Klicka på kopieringsikonen på valfritt meddelande för att kopiera det till urklipp
  • Tryck på Shift + Return för en ny rad utan att skicka

Nedre verktygsfältet

ElementBeskrivning
Model dropdownVälj vilken modell som ska användas
Download iconÖppna Model Manager
Load / Unload iconLadda eller avlasta nuvarande modell manuellt
Status labelVisar “Generating…” under svar

Modellhantering

Öppna med nedladdningsikonen i verktygsfältet.

  • Downloaded tab — Listar alla modeller på din disk. Ta bort modeller du inte längre behöver för att frigöra utrymme.
  • Recommend tab — Kuraterad lista över populära modeller med nedladdning med ett klick. Diskutrymme visas före nedladdning.
  • Browse tab — Sök direkt på Hugging Face. Filtrera efter namn och bläddra bland tillgängliga GGUF-filer för valfritt arkiv.

Var modeller lagras

OSSökväg
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Inställningar

Nås från kugghjulsikonen (nere till vänster) eller appens meny.

InställningBeskrivningStandard
TemperatureKreativitetsnivå (0.0 = fokuserad, 1.0+ = kreativ)0.7
Max TokensMaximal svarslängd512
Context SizeHur mycket konversationshistorik modellen ser2048
System PromptInstruktioner som ges till modellen före varje konversation“You are a helpful assistant.”
API EnabledStarta en lokal REST API-serverOn
API PortPortnummer för API-servern8800

Välj rätt inställningar

  • Temperature — Lägre (0.1–0.3) för faktabaserade svar. Högre (0.7–1.0) för kreativt skrivande.
  • Max Tokens — Öka för längre svar. 512 är bra för de flesta konversationer.
  • Context Size — Större värden låter modellen komma ihåg mer av konversationen, men använder mer RAM.

REST API

DeskLLM kör en lokal API-server som är kompatibel med OpenAI-formatet. Andra appar på din dator kan använda den.

Endpoint: http://localhost:8800

Exempel (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Exempel (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Tangentbordsgenvägar

ÅtgärdmacOSWindows
Visa / Dölj fönsterCtrl + Cmd + F8Ctrl + Alt + F8
Skicka meddelandeReturnReturn
Ny radShift + ReturnShift + Return
Ny chattCmd + NCtrl + N

Tips

  • Byt modeller fritt — Du kan byta modeller mitt i en konversation när som helst.
  • System prompt — Anpassa den för olika användningsfall: översättare, kodassistent, skrivhjälp osv.
  • Flera sessioner — Håll separata konversationer för olika ämnen. Sidofältet gör det enkelt att växla.
  • Offline-användning — När en modell är nedladdad fungerar DeskLLM helt offline.
  • API-integration — Använd det inbyggda API:et för att ansluta DeskLLM med andra verktyg, skript eller appar på din maskin.

Felsökning

ProblemLösning
Modellen laddas inteKontrollera tillgänglig RAM. Mindre kvantisering (Q4_K_M) använder mindre minne.
Långsamma svarProva en mindre modell. Stäng andra minneskrävande appar.
Förvrängd utdataSänk temperaturen. Prova en annan modell.
Nedladdning misslyckasKontrollera internetanslutningen. Försök igen — nedladdningar återupptas automatiskt.
Appen startar inteTa bort inställningsfilen och starta om.

Integritet

  • All AI-bearbetning sker lokalt på din dator
  • Ingen data skickas till någon extern server
  • Chatthistorik lagras endast på din lokala disk
  • Modeller laddas ner från Hugging Face (den enda nätverksåtkomsten)