DeskLLM - Przewodnik

Czatuj z modelami AI działającymi w całości na twoim komputerze. Bez internetu, żadne dane nie opuszczają twojego urządzenia.


Pierwsze kroki

1. Pobierz model

DeskLLM potrzebuje modelu językowego do działania. Przy pierwszym uruchomieniu kliknij ikonę pobierania w dolnym pasku narzędzi, aby otworzyć Model Manager.

Recommend tab — Wybierz model, który pasuje do twojego komputera:

KategoriaRAMNajlepszy do
Ultra Light4 GB+Szybkie odpowiedzi, minimalne zasoby
Light8 GB+Codzienne zadania, pomocnik w tle
Standard16 GB+Czat, pisanie, podsumowywanie
High-End32 GB+Złożone rozumowanie, generowanie kodu

Kliknij Download na dowolnej karcie modelu. Postęp pobierania jest pokazywany w czasie rzeczywistym.

Browse tab — Przeszukuj Hugging Face dla dowolnego modelu GGUF według słowa kluczowego.

2. Rozpocznij rozmowę

  1. Wybierz model z rozwijanej listy w dolnym pasku narzędzi
  2. Kliknij ikonę ładowania (model ładuje się automatycznie przy pierwszej wiadomości, jeśli nie został załadowany)
  3. Wpisz wiadomość i naciśnij Return, aby wysłać
  4. AI odpowiada w czasie rzeczywistym, token po tokenie

Przegląd interfejsu

Pasek boczny

Przełączaj ikoną hamburgera (lewy górny róg). Pokazuje twoje sesje czatu.

  • Kliknij sesję, aby się do niej przełączyć
  • Kliknij prawym przyciskiem myszy, aby Rename lub Delete
  • Kliknij + New Chat, aby rozpocząć nową rozmowę

Obszar czatu

  • Twoje wiadomości pojawiają się po prawej stronie (kolorowe dymki)
  • Odpowiedzi AI pojawiają się po lewej stronie
  • Kliknij ikonę kopiowania na dowolnej wiadomości, aby skopiować ją do schowka
  • Naciśnij Shift + Return, aby przejść do nowej linii bez wysyłania

Dolny pasek narzędzi

ElementOpis
Model dropdownWybierz model do użycia
Download iconOtwórz Model Manager
Load / Unload iconRęcznie załaduj lub wyładuj bieżący model
Status labelPokazuje “Generating…” podczas odpowiedzi

Zarządzanie modelami

Otwórz ikoną pobierania w pasku narzędzi.

  • Downloaded tab — Lista wszystkich modeli na twoim dysku. Usuń modele, których już nie potrzebujesz, aby zwolnić miejsce.
  • Recommend tab — Wyselekcjonowana lista popularnych modeli z pobieraniem jednym kliknięciem. Miejsce na dysku jest pokazywane przed pobraniem.
  • Browse tab — Przeszukuj bezpośrednio Hugging Face. Filtruj po nazwie i przeglądaj dostępne pliki GGUF dla dowolnego repozytorium.

Gdzie są przechowywane modele

OSŚcieżka
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Ustawienia

Dostęp z ikony koła zębatego (lewy dolny róg) lub z menu aplikacji.

UstawienieOpisDomyślnie
TemperaturePoziom kreatywności (0.0 = skupiony, 1.0+ = kreatywny)0.7
Max TokensMaksymalna długość odpowiedzi512
Context SizeIle historii rozmowy widzi model2048
System PromptInstrukcje przekazywane modelowi przed każdą rozmową“You are a helpful assistant.”
API EnabledUruchom lokalny serwer REST APIOn
API PortNumer portu serwera API8800

Wybór odpowiednich ustawień

  • Temperature — Niższa (0.1–0.3) dla rzeczowych odpowiedzi. Wyższa (0.7–1.0) dla kreatywnego pisania.
  • Max Tokens — Zwiększ dla dłuższych odpowiedzi. 512 jest dobre dla większości rozmów.
  • Context Size — Większe wartości pozwalają modelowi pamiętać więcej z rozmowy, ale zużywają więcej RAM.

REST API

DeskLLM uruchamia lokalny serwer API kompatybilny z formatem OpenAI. Inne aplikacje na twoim komputerze mogą z niego korzystać.

Endpoint: http://localhost:8800

Przykład (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Przykład (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Skróty klawiszowe

AkcjamacOSWindows
Pokaż / Ukryj oknoCtrl + Cmd + F8Ctrl + Alt + F8
Wyślij wiadomośćReturnReturn
Nowa liniaShift + ReturnShift + Return
Nowy czatCmd + NCtrl + N

Wskazówki

  • Swobodnie zmieniaj modele — Możesz zmienić model w trakcie rozmowy w dowolnym momencie.
  • System prompt — Dostosuj go do różnych zastosowań: tłumacz, asystent kodowania, pomocnik pisania itp.
  • Wiele sesji — Prowadź oddzielne rozmowy na różne tematy. Pasek boczny ułatwia przełączanie.
  • Użycie offline — Po pobraniu modelu DeskLLM działa całkowicie offline.
  • Integracja z API — Użyj wbudowanego API, aby połączyć DeskLLM z innymi narzędziami, skryptami lub aplikacjami na twoim komputerze.

Rozwiązywanie problemów

ProblemRozwiązanie
Model nie ładuje sięSprawdź dostępną pamięć RAM. Mniejsza kwantyzacja (Q4_K_M) zużywa mniej pamięci.
Wolne odpowiedziSpróbuj mniejszego modelu. Zamknij inne aplikacje obciążające pamięć.
Zniekształcone wyjścieObniż temperaturę. Wypróbuj inny model.
Pobieranie nie powiodło sięSprawdź połączenie internetowe. Spróbuj ponownie — pobieranie wznawia się automatycznie.
Aplikacja nie uruchamia sięUsuń plik ustawień i uruchom ponownie.

Prywatność

  • Cała obróbka AI odbywa się lokalnie na twoim komputerze
  • Żadne dane nie są wysyłane na żaden zewnętrzny serwer
  • Historia czatu jest przechowywana tylko na twoim lokalnym dysku
  • Modele są pobierane z Hugging Face (jedyny dostęp do sieci)