DeskLLM - Посібник

Спілкуйтеся з AI моделями, які працюють повністю на вашому настільному комп'ютері. Не потрібен інтернет, жодні дані не залишають ваш пристрій.


Початок роботи

1. Завантажте модель

DeskLLM потребує мовну модель для роботи. При першому запуску клацніть значок завантаження на нижній панелі інструментів, щоб відкрити Model Manager.

Recommend tab — Виберіть модель, яка підходить вашому комп'ютеру:

КатегоріяRAMНайкраще для
Ultra Light4 GB+Швидкі відповіді, мінімальні ресурси
Light8 GB+Щоденні завдання, фоновий помічник
Standard16 GB+Чат, письмо, узагальнення
High-End32 GB+Складні міркування, генерація коду

Клацніть Download на будь-якій картці моделі. Прогрес завантаження показується в реальному часі.

Browse tab — Шукайте на Hugging Face будь-яку модель GGUF за ключовим словом.

2. Почніть спілкуватися

  1. Виберіть модель з випадаючого меню на нижній панелі інструментів
  2. Клацніть значок завантаження (модель завантажується автоматично при першому повідомленні, якщо не завантажена)
  3. Введіть повідомлення та натисніть Return, щоб надіслати
  4. AI відповідає в реальному часі, токен за токеном

Огляд інтерфейсу

Бічна панель

Перемикайте значком гамбургера (зверху ліворуч). Показує ваші чат-сесії.

  • Клацніть сесію, щоб переключитися на неї
  • Клацніть правою кнопкою для Rename або Delete
  • Клацніть + New Chat, щоб почати нову розмову

Область чату

  • Ваші повідомлення з'являються праворуч (кольорові бульбашки)
  • Відповіді AI з'являються ліворуч
  • Клацніть значок копіювання на будь-якому повідомленні, щоб скопіювати його в буфер обміну
  • Натисніть Shift + Return для нового рядка без надсилання

Нижня панель інструментів

ЕлементОпис
Model dropdownВиберіть модель для використання
Download iconВідкрити Model Manager
Load / Unload iconВручну завантажити або вивантажити поточну модель
Status labelПоказує “Generating…” під час відповіді

Управління моделями

Відкривається значком завантаження на панелі інструментів.

  • Downloaded tab — Список усіх моделей на вашому диску. Видаляйте моделі, які вам більше не потрібні, щоб звільнити місце.
  • Recommend tab — Кураторський список популярних моделей із завантаженням одним кліком. Простір на диску показується перед завантаженням.
  • Browse tab — Шукайте безпосередньо на Hugging Face. Фільтруйте за назвою та переглядайте доступні файли GGUF для будь-якого репозиторію.

Де зберігаються моделі

OSШлях
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Налаштування

Доступ через значок шестерні (внизу ліворуч) або з меню програми.

НалаштуванняОписЗа замовчуванням
TemperatureРівень креативності (0.0 = зосереджений, 1.0+ = креативний)0.7
Max TokensМаксимальна довжина відповіді512
Context SizeСкільки історії розмови бачить модель2048
System PromptІнструкції, що даються моделі перед кожною розмовою“You are a helpful assistant.”
API EnabledЗапустити локальний REST API серверOn
API PortНомер порту для API сервера8800

Вибір правильних налаштувань

  • Temperature — Нижче (0.1–0.3) для фактичних відповідей. Вище (0.7–1.0) для творчого письма.
  • Max Tokens — Збільшуйте для довших відповідей. 512 підходить для більшості розмов.
  • Context Size — Більші значення дозволяють моделі пам'ятати більше з розмови, але використовують більше RAM.

REST API

DeskLLM запускає локальний API сервер, сумісний з форматом OpenAI. Інші програми на вашому комп'ютері можуть його використовувати.

Endpoint: http://localhost:8800

Приклад (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Приклад (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Гарячі клавіші

ДіяmacOSWindows
Показати / Сховати вікноCtrl + Cmd + F8Ctrl + Alt + F8
Надіслати повідомленняReturnReturn
Новий рядокShift + ReturnShift + Return
Новий чатCmd + NCtrl + N

Поради

  • Вільно перемикайте моделі — Ви можете змінювати моделі посеред розмови в будь-який час.
  • System prompt — Налаштуйте його для різних випадків використання: перекладач, помічник з кодування, помічник з письма тощо.
  • Кілька сесій — Тримайте окремі розмови для різних тем. Бічна панель полегшує перемикання.
  • Офлайн-використання — Після завантаження моделі DeskLLM працює повністю офлайн.
  • Інтеграція з API — Використовуйте вбудований API для з'єднання DeskLLM з іншими інструментами, скриптами або програмами на вашому комп'ютері.

Усунення несправностей

ПроблемаРішення
Модель не завантажуєтьсяПеревірте доступну RAM. Менше квантування (Q4_K_M) використовує менше пам'яті.
Повільні відповідіСпробуйте меншу модель. Закрийте інші програми, що споживають багато пам'яті.
Спотворений вихідЗменшіть температуру. Спробуйте іншу модель.
Завантаження не вдалосяПеревірте інтернет-з'єднання. Спробуйте знову — завантаження автоматично відновлюється.
Програма не запускаєтьсяВидаліть файл налаштувань та перезапустіть.

Конфіденційність

  • Уся обробка AI відбувається локально на вашому комп'ютері
  • Жодні дані не надсилаються на жоден зовнішній сервер
  • Історія чату зберігається лише на вашому локальному диску
  • Моделі завантажуються з Hugging Face (єдиний мережевий доступ)