Спілкуйтеся з AI моделями, які працюють повністю на вашому настільному комп'ютері. Не потрібен інтернет, жодні дані не залишають ваш пристрій.
Початок роботи
1. Завантажте модель
DeskLLM потребує мовну модель для роботи. При першому запуску клацніть значок завантаження на нижній панелі інструментів, щоб відкрити Model Manager.
Recommend tab — Виберіть модель, яка підходить вашому комп'ютеру:
| Категорія | RAM | Найкраще для |
|---|---|---|
| Ultra Light | 4 GB+ | Швидкі відповіді, мінімальні ресурси |
| Light | 8 GB+ | Щоденні завдання, фоновий помічник |
| Standard | 16 GB+ | Чат, письмо, узагальнення |
| High-End | 32 GB+ | Складні міркування, генерація коду |
Клацніть Download на будь-якій картці моделі. Прогрес завантаження показується в реальному часі.
Browse tab — Шукайте на Hugging Face будь-яку модель GGUF за ключовим словом.
2. Почніть спілкуватися
- Виберіть модель з випадаючого меню на нижній панелі інструментів
- Клацніть значок завантаження (модель завантажується автоматично при першому повідомленні, якщо не завантажена)
- Введіть повідомлення та натисніть Return, щоб надіслати
- AI відповідає в реальному часі, токен за токеном
Огляд інтерфейсу
Бічна панель
Перемикайте значком гамбургера (зверху ліворуч). Показує ваші чат-сесії.
- Клацніть сесію, щоб переключитися на неї
- Клацніть правою кнопкою для Rename або Delete
- Клацніть + New Chat, щоб почати нову розмову
Область чату
- Ваші повідомлення з'являються праворуч (кольорові бульбашки)
- Відповіді AI з'являються ліворуч
- Клацніть значок копіювання на будь-якому повідомленні, щоб скопіювати його в буфер обміну
- Натисніть Shift + Return для нового рядка без надсилання
Нижня панель інструментів
| Елемент | Опис |
|---|---|
| Model dropdown | Виберіть модель для використання |
| Download icon | Відкрити Model Manager |
| Load / Unload icon | Вручну завантажити або вивантажити поточну модель |
| Status label | Показує “Generating…” під час відповіді |
Управління моделями
Відкривається значком завантаження на панелі інструментів.
- Downloaded tab — Список усіх моделей на вашому диску. Видаляйте моделі, які вам більше не потрібні, щоб звільнити місце.
- Recommend tab — Кураторський список популярних моделей із завантаженням одним кліком. Простір на диску показується перед завантаженням.
- Browse tab — Шукайте безпосередньо на Hugging Face. Фільтруйте за назвою та переглядайте доступні файли GGUF для будь-якого репозиторію.
Де зберігаються моделі
| OS | Шлях |
|---|---|
| macOS | ~/Library/Application Support/DeskAssist/llm_models/ |
| Windows | %APPDATA%/DeskAssist/llm_models/ |
Налаштування
Доступ через значок шестерні (внизу ліворуч) або з меню програми.
| Налаштування | Опис | За замовчуванням |
|---|---|---|
| Temperature | Рівень креативності (0.0 = зосереджений, 1.0+ = креативний) | 0.7 |
| Max Tokens | Максимальна довжина відповіді | 512 |
| Context Size | Скільки історії розмови бачить модель | 2048 |
| System Prompt | Інструкції, що даються моделі перед кожною розмовою | “You are a helpful assistant.” |
| API Enabled | Запустити локальний REST API сервер | On |
| API Port | Номер порту для API сервера | 8800 |
Вибір правильних налаштувань
- Temperature — Нижче (0.1–0.3) для фактичних відповідей. Вище (0.7–1.0) для творчого письма.
- Max Tokens — Збільшуйте для довших відповідей. 512 підходить для більшості розмов.
- Context Size — Більші значення дозволяють моделі пам'ятати більше з розмови, але використовують більше RAM.
REST API
DeskLLM запускає локальний API сервер, сумісний з форматом OpenAI. Інші програми на вашому комп'ютері можуть його використовувати.
Endpoint: http://localhost:8800
Приклад (curl)
curl http://localhost:8800/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"messages": [{"role": "user", "content": "Hello!"}],
"stream": true
}'
Приклад (Python)
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
model="local",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)
Гарячі клавіші
| Дія | macOS | Windows |
|---|---|---|
| Показати / Сховати вікно | Ctrl + Cmd + F8 | Ctrl + Alt + F8 |
| Надіслати повідомлення | Return | Return |
| Новий рядок | Shift + Return | Shift + Return |
| Новий чат | Cmd + N | Ctrl + N |
Поради
- Вільно перемикайте моделі — Ви можете змінювати моделі посеред розмови в будь-який час.
- System prompt — Налаштуйте його для різних випадків використання: перекладач, помічник з кодування, помічник з письма тощо.
- Кілька сесій — Тримайте окремі розмови для різних тем. Бічна панель полегшує перемикання.
- Офлайн-використання — Після завантаження моделі DeskLLM працює повністю офлайн.
- Інтеграція з API — Використовуйте вбудований API для з'єднання DeskLLM з іншими інструментами, скриптами або програмами на вашому комп'ютері.
Усунення несправностей
| Проблема | Рішення |
|---|---|
| Модель не завантажується | Перевірте доступну RAM. Менше квантування (Q4_K_M) використовує менше пам'яті. |
| Повільні відповіді | Спробуйте меншу модель. Закрийте інші програми, що споживають багато пам'яті. |
| Спотворений вихід | Зменшіть температуру. Спробуйте іншу модель. |
| Завантаження не вдалося | Перевірте інтернет-з'єднання. Спробуйте знову — завантаження автоматично відновлюється. |
| Програма не запускається | Видаліть файл налаштувань та перезапустіть. |
Конфіденційність
- Уся обробка AI відбувається локально на вашому комп'ютері
- Жодні дані не надсилаються на жоден зовнішній сервер
- Історія чату зберігається лише на вашому локальному диску
- Моделі завантажуються з Hugging Face (єдиний мережевий доступ)