Chatujte s AI modely běžícími zcela na vašem počítači. Bez internetu, žádná data neopouštějí vaše zařízení.
Začínáme
1. Stáhněte model
DeskLLM potřebuje k fungování jazykový model. Při prvním spuštění klikněte na ikonu stahování v dolním panelu nástrojů, abyste otevřeli Model Manager.
Recommend tab — Vyberte model, který se hodí k vašemu počítači:
| Kategorie | RAM | Nejlepší pro |
|---|---|---|
| Ultra Light | 4 GB+ | Rychlé odpovědi, minimální zdroje |
| Light | 8 GB+ | Každodenní úkoly, asistent na pozadí |
| Standard | 16 GB+ | Chat, psaní, sumarizace |
| High-End | 32 GB+ | Složené uvažování, generování kódu |
Klikněte na Download u libovolné karty modelu. Průběh stahování je zobrazen v reálném čase.
Browse tab — Prohledejte Hugging Face pro libovolný GGUF model podle klíčového slova.
2. Začněte chatovat
- Vyberte model z rozbalovacího menu v dolním panelu nástrojů
- Klikněte na ikonu načtení (model se načte automaticky při první zprávě, pokud není načten)
- Napište zprávu a stiskněte Return pro odeslání
- AI odpovídá v reálném čase, token po tokenu
Přehled rozhraní
Postranní panel
Přepněte ikonou hamburgeru (vlevo nahoře). Zobrazuje vaše chat relace.
- Klikněte na relaci pro přepnutí
- Klikněte pravým tlačítkem pro Rename nebo Delete
- Klikněte na + New Chat pro zahájení nové konverzace
Oblast chatu
- Vaše zprávy se zobrazují vpravo (barevné bubliny)
- Odpovědi AI se zobrazují vlevo
- Klikněte na ikonu kopírování u libovolné zprávy pro zkopírování do schránky
- Stiskněte Shift + Return pro nový řádek bez odeslání
Dolní panel nástrojů
| Prvek | Popis |
|---|---|
| Model dropdown | Vyberte model, který chcete použít |
| Download icon | Otevřete Model Manager |
| Load / Unload icon | Ručně načtěte nebo uvolněte aktuální model |
| Status label | Zobrazuje “Generating…” během odpovědi |
Správa modelů
Otevřete ikonou stahování v panelu nástrojů.
- Downloaded tab — Seznam všech modelů na vašem disku. Smažte modely, které již nepotřebujete, abyste uvolnili místo.
- Recommend tab — Kurátorovaný seznam populárních modelů s jednoklikovým stažením. Místo na disku se zobrazuje před stahováním.
- Browse tab — Prohledávejte Hugging Face přímo. Filtrujte podle názvu a procházejte dostupné GGUF soubory pro libovolné úložiště.
Kde jsou modely uloženy
| OS | Cesta |
|---|---|
| macOS | ~/Library/Application Support/DeskAssist/llm_models/ |
| Windows | %APPDATA%/DeskAssist/llm_models/ |
Nastavení
Přístup z ikony ozubeného kola (vlevo dole) nebo z menu aplikace.
| Nastavení | Popis | Výchozí |
|---|---|---|
| Temperature | Úroveň kreativity (0.0 = zaměřený, 1.0+ = kreativní) | 0.7 |
| Max Tokens | Maximální délka odpovědi | 512 |
| Context Size | Kolik historie konverzace model vidí | 2048 |
| System Prompt | Pokyny dané modelu před každou konverzací | “You are a helpful assistant.” |
| API Enabled | Spustí lokální REST API server | On |
| API Port | Číslo portu API serveru | 8800 |
Volba správného nastavení
- Temperature — Nižší (0.1–0.3) pro faktické odpovědi. Vyšší (0.7–1.0) pro kreativní psaní.
- Max Tokens — Zvyšte pro delší odpovědi. 512 je dobré pro většinu konverzací.
- Context Size — Větší hodnoty umožňují modelu pamatovat si více konverzace, ale využívají více RAM.
REST API
DeskLLM provozuje lokální API server kompatibilní s formátem OpenAI. Ostatní aplikace na vašem počítači jej mohou používat.
Endpoint: http://localhost:8800
Příklad (curl)
curl http://localhost:8800/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"messages": [{"role": "user", "content": "Hello!"}],
"stream": true
}'
Příklad (Python)
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
model="local",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)
Klávesové zkratky
| Akce | macOS | Windows |
|---|---|---|
| Zobrazit / Skrýt okno | Ctrl + Cmd + F8 | Ctrl + Alt + F8 |
| Odeslat zprávu | Return | Return |
| Nový řádek | Shift + Return | Shift + Return |
| Nový chat | Cmd + N | Ctrl + N |
Tipy
- Volně přepínejte modely — Můžete změnit modely uprostřed konverzace kdykoli.
- System prompt — Přizpůsobte jej pro různé případy použití: překladač, asistent kódování, pomocník psaní atd.
- Více relací — Udržujte oddělené konverzace pro různá témata. Postranní panel usnadňuje přepínání.
- Použití offline — Jakmile je model stažen, DeskLLM funguje zcela offline.
- Integrace API — Použijte vestavěné API k propojení DeskLLM s jinými nástroji, skripty nebo aplikacemi na vašem počítači.
Řešení problémů
| Problém | Řešení |
|---|---|
| Model se nenačte | Zkontrolujte dostupnou RAM. Menší kvantizace (Q4_K_M) využívá méně paměti. |
| Pomalé odpovědi | Zkuste menší model. Zavřete jiné aplikace náročné na paměť. |
| Zkomolený výstup | Snižte teplotu. Zkuste jiný model. |
| Stahování selhává | Zkontrolujte připojení k internetu. Zkuste znovu — stahování se obnoví automaticky. |
| Aplikace se nespustí | Smažte soubor nastavení a spusťte znovu. |
Soukromí
- Veškeré zpracování AI probíhá lokálně na vašem počítači
- Žádná data nejsou odesílána na žádný externí server
- Historie chatu je uložena pouze na vašem lokálním disku
- Modely jsou stahovány z Hugging Face (jediný síťový přístup)