Discutați cu modele AI care rulează în întregime pe desktopul dvs. Fără internet, nicio dată nu părăsește dispozitivul dvs.
Primii pași
1. Descărcați un model
DeskLLM are nevoie de un model lingvistic pentru a funcționa. La prima lansare, faceți clic pe pictograma de descărcare din bara de instrumente de jos pentru a deschide Model Manager.
Recommend tab — Alegeți un model care se potrivește computerului dvs.:
| Categorie | RAM | Cel mai bun pentru |
|---|---|---|
| Ultra Light | 4 GB+ | Răspunsuri rapide, resurse minime |
| Light | 8 GB+ | Sarcini zilnice, asistent de fundal |
| Standard | 16 GB+ | Chat, scriere, sumarizare |
| High-End | 32 GB+ | Raționament complex, generare cod |
Faceți clic pe Download pe orice card de model. Progresul descărcării este afișat în timp real.
Browse tab — Căutați pe Hugging Face orice model GGUF după cuvânt cheie.
2. Începeți să discutați
- Selectați un model din meniul derulant din bara de instrumente de jos
- Faceți clic pe pictograma de încărcare (modelul se încarcă automat la primul mesaj dacă nu este încărcat)
- Tastați mesajul și apăsați Return pentru a trimite
- AI răspunde în timp real, token cu token
Prezentare generală a interfeței
Bară laterală
Comutați cu pictograma hamburger (stânga sus). Afișează sesiunile de chat.
- Faceți clic pe o sesiune pentru a comuta la ea
- Faceți clic dreapta pentru Rename sau Delete
- Faceți clic pe + New Chat pentru a începe o conversație nouă
Zona de chat
- Mesajele dvs. apar în dreapta (bule colorate)
- Răspunsurile AI apar în stânga
- Faceți clic pe pictograma de copiere pe orice mesaj pentru a-l copia în clipboard
- Apăsați Shift + Return pentru o linie nouă fără a trimite
Bară de instrumente de jos
| Element | Descriere |
|---|---|
| Model dropdown | Selectați modelul de utilizat |
| Download icon | Deschideți Model Manager |
| Load / Unload icon | Încărcați sau descărcați manual modelul curent |
| Status label | Afișează “Generating…” în timpul răspunsului |
Gestionarea modelelor
Deschideți cu pictograma de descărcare din bara de instrumente.
- Downloaded tab — Listează toate modelele de pe disc. Ștergeți modelele de care nu mai aveți nevoie pentru a elibera spațiu.
- Recommend tab — Listă curată de modele populare cu descărcare cu un singur clic. Spațiul pe disc este afișat înainte de descărcare.
- Browse tab — Căutați direct pe Hugging Face. Filtrați după nume și răsfoiți fișierele GGUF disponibile pentru orice depozit.
Unde sunt stocate modelele
| OS | Cale |
|---|---|
| macOS | ~/Library/Application Support/DeskAssist/llm_models/ |
| Windows | %APPDATA%/DeskAssist/llm_models/ |
Setări
Acces din pictograma roată dințată (stânga jos) sau din meniul aplicației.
| Setare | Descriere | Implicit |
|---|---|---|
| Temperature | Nivel de creativitate (0.0 = concentrat, 1.0+ = creativ) | 0.7 |
| Max Tokens | Lungimea maximă a răspunsului | 512 |
| Context Size | Cât din istoricul conversației vede modelul | 2048 |
| System Prompt | Instrucțiuni date modelului înainte de fiecare conversație | “You are a helpful assistant.” |
| API Enabled | Pornește un server REST API local | On |
| API Port | Numărul portului pentru serverul API | 8800 |
Alegerea setărilor potrivite
- Temperature — Mai scăzut (0.1–0.3) pentru răspunsuri factuale. Mai ridicat (0.7–1.0) pentru scriere creativă.
- Max Tokens — Măriți pentru răspunsuri mai lungi. 512 este bun pentru majoritatea conversațiilor.
- Context Size — Valori mai mari permit modelului să-și amintească mai mult din conversație, dar folosesc mai multă RAM.
REST API
DeskLLM rulează un server API local compatibil cu formatul OpenAI. Alte aplicații de pe computerul dvs. îl pot folosi.
Endpoint: http://localhost:8800
Exemplu (curl)
curl http://localhost:8800/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"messages": [{"role": "user", "content": "Hello!"}],
"stream": true
}'
Exemplu (Python)
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
model="local",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)
Comenzi rapide de la tastatură
| Acțiune | macOS | Windows |
|---|---|---|
| Afișare / Ascundere fereastră | Ctrl + Cmd + F8 | Ctrl + Alt + F8 |
| Trimite mesaj | Return | Return |
| Linie nouă | Shift + Return | Shift + Return |
| Chat nou | Cmd + N | Ctrl + N |
Sfaturi
- Schimbați modele liber — Puteți schimba modele în timpul conversației oricând.
- System prompt — Personalizați-l pentru diferite cazuri de utilizare: traducător, asistent de codare, ajutor pentru scriere etc.
- Sesiuni multiple — Păstrați conversații separate pentru subiecte diferite. Bara laterală facilitează comutarea.
- Utilizare offline — Odată descărcat un model, DeskLLM funcționează complet offline.
- Integrare API — Folosiți API-ul încorporat pentru a conecta DeskLLM cu alte instrumente, scripturi sau aplicații de pe mașina dvs.
Depanare
| Problemă | Soluție |
|---|---|
| Modelul nu se încarcă | Verificați RAM-ul disponibil. Cuantizarea mai mică (Q4_K_M) folosește mai puțină memorie. |
| Răspunsuri lente | Încercați un model mai mic. Închideți alte aplicații care consumă mult memorie. |
| Ieșire deformată | Reduceți temperatura. Încercați un model diferit. |
| Descărcarea eșuează | Verificați conexiunea la internet. Încercați din nou — descărcările se reiau automat. |
| Aplicația nu pornește | Ștergeți fișierul de setări și relansați. |
Confidențialitate
- Toată procesarea AI are loc local pe computerul dvs.
- Niciun fel de date nu sunt trimise pe niciun server extern
- Istoricul chatului este stocat doar pe discul dvs. local
- Modelele sunt descărcate de pe Hugging Face (singurul acces la rețea)