DeskLLM - Opas

Keskustele tekoälymalleista, jotka toimivat kokonaan työpöydälläsi. Internetiä ei tarvita, eikä mitään tietoja poistu laitteeltasi.


Aloitus

1. Lataa malli

DeskLLM tarvitsee kielimallin toimiakseen. Ensimmäisellä käynnistyskerralla napsauta latauskuvaketta alapalkissa avataksesi Model Managerin.

Recommend tab — Valitse malli, joka sopii tietokoneeseesi:

LuokkaRAMSoveltuu
Ultra Light4 GB+Nopeat vastaukset, vähäiset resurssit
Light8 GB+Päivittäiset tehtävät, taustatuki
Standard16 GB+Keskustelu, kirjoittaminen, tiivistäminen
High-End32 GB+Monimutkainen päättely, koodin luonti

Napsauta Download millä tahansa mallikortilla. Latauksen edistyminen näkyy reaaliajassa.

Browse tab — Etsi mitä tahansa GGUF-mallia Hugging Facesta avainsanalla.

2. Aloita keskustelu

  1. Valitse malli alapalkin pudotusvalikosta
  2. Napsauta lataa-kuvaketta (malli latautuu automaattisesti ensimmäisen viestin yhteydessä, jos sitä ei ole vielä ladattu)
  3. Kirjoita viestisi ja paina Return lähettääksesi
  4. Tekoäly vastaa reaaliajassa, token kerrallaan

Käyttöliittymän yleiskatsaus

Sivupalkki

Vaihda näkyvyys hampurilaiskuvakkeella (vasen yläkulma). Näyttää chat-istuntosi.

  • Napsauta istuntoa vaihtaaksesi siihen
  • Napsauta hiiren oikealla painikkeella valitaksesi Rename tai Delete
  • Napsauta + New Chat aloittaaksesi uuden keskustelun

Chat-alue

  • Sinun viestisi näkyvät oikealla (värilliset kuplat)
  • Tekoälyn vastaukset näkyvät vasemmalla
  • Napsauta minkä tahansa viestin kopioi-kuvaketta kopioidaksesi sen leikepöydälle
  • Paina Shift + Return lisätäksesi rivinvaihdon ilman lähettämistä

Alapalkki

ElementtiKuvaus
Model dropdownValitse käytettävä malli
Download iconAvaa Model Manager
Load / Unload iconLataa tai poista nykyinen malli manuaalisesti
Status labelNäyttää “Generating…” vastauksen aikana

Mallien hallinta

Avaa työkalupalkin latauskuvakkeesta.

  • Downloaded tab — Listaa kaikki levyllesi tallennetut mallit. Poista mallit, joita et enää tarvitse, vapauttaaksesi tilaa.
  • Recommend tab — Kuratoitu lista suosituista malleista yhdellä napsautuksella ladattavissa. Levytila näytetään ennen lataamista.
  • Browse tab — Etsi suoraan Hugging Facesta. Suodata nimellä ja selaa minkä tahansa repositoryn käytettävissä olevia GGUF-tiedostoja.

Missä mallit tallennetaan

OSPolku
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Asetukset

Avaa rataskuvakkeesta (vasen alakulma) tai sovelluksen valikosta.

AsetusKuvausOletus
TemperatureLuovuustaso (0,0 = keskittynyt, 1,0+ = luova)0.7
Max TokensVastauksen enimmäispituus512
Context SizeKuinka paljon keskusteluhistoriaa malli näkee2048
System PromptMallille ennen jokaista keskustelua annettavat ohjeet“You are a helpful assistant.”
API EnabledKäynnistä paikallinen REST API -palvelinOn
API PortAPI-palvelimen porttinumero8800

Oikeiden asetusten valinta

  • Temperature — Pienempi (0,1–0,3) faktoihin perustuviin vastauksiin. Suurempi (0,7–1,0) luovaan kirjoittamiseen.
  • Max Tokens — Suurenna pidempiä vastauksia varten. 512 sopii useimpiin keskusteluihin.
  • Context Size — Suuremmat arvot antavat mallin muistaa enemmän keskustelusta, mutta käyttävät enemmän RAM-muistia.

REST API

DeskLLM käyttää OpenAI-yhteensopivaa paikallista API-palvelinta. Muut tietokoneesi sovellukset voivat käyttää sitä.

Endpoint: http://localhost:8800

Esimerkki (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Esimerkki (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Pikanäppäimet

ToimintomacOSWindows
Näytä / piilota ikkunaCtrl + Cmd + F8Ctrl + Alt + F8
Lähetä viestiReturnReturn
Uusi riviShift + ReturnShift + Return
Uusi keskusteluCmd + NCtrl + N

Vinkkejä

  • Vaihda malleja vapaasti — Voit vaihtaa malleja milloin tahansa kesken keskustelun.
  • System prompt — Mukauta sitä eri käyttötapauksiin: kääntäjä, koodausavustaja, kirjoitusavustaja jne.
  • Useita istuntoja — Pidä erilliset keskustelut eri aiheille. Sivupalkki helpottaa vaihtamista.
  • Offline-käyttö — Kun malli on ladattu, DeskLLM toimii täysin offline-tilassa.
  • API-integrointi — Käytä sisäänrakennettua APIa yhdistääksesi DeskLLM:n muihin koneesi työkaluihin, skripteihin tai sovelluksiin.

Vianetsintä

OngelmaRatkaisu
Malli ei latauduTarkista käytettävissä oleva RAM. Pienempi kvantisointi (Q4_K_M) käyttää vähemmän muistia.
Hitaat vastauksetKokeile pienempää mallia. Sulje muut paljon muistia käyttävät sovellukset.
Sekava tulostePienennä lämpötilaa. Kokeile eri mallia.
Lataus epäonnistuuTarkista internetyhteys. Yritä uudelleen — lataukset jatkuvat automaattisesti.
Sovellus ei käynnistyPoista asetustiedosto ja käynnistä uudelleen.

Yksityisyys

  • Kaikki tekoälyn käsittely tapahtuu paikallisesti tietokoneellasi
  • Mitään tietoja ei lähetetä millekään ulkoiselle palvelimelle
  • Chat-historia tallennetaan vain paikalliselle levyllesi
  • Mallit ladataan Hugging Facesta (ainoa verkkoyhteys)