DeskLLM - Руководство

Общайтесь с ИИ-моделями, работающими полностью на вашем компьютере. Интернет не нужен, данные не покидают ваше устройство.


Начало работы

1. Загрузите модель

Для работы DeskLLM нужна языковая модель. При первом запуске нажмите значок загрузки на нижней панели инструментов, чтобы открыть Model Manager.

Recommend tab — Выберите модель, подходящую для вашего компьютера:

КатегорияRAMПодходит для
Ultra Light4 GB+Быстрые ответы, минимальные ресурсы
Light8 GB+Повседневные задачи, фоновый ассистент
Standard16 GB+Чат, написание текстов, резюме
High-End32 GB+Сложные рассуждения, генерация кода

Нажмите Download на любой карточке модели. Прогресс загрузки отображается в реальном времени.

Browse tab — Ищите на Hugging Face любую модель GGUF по ключевому слову.

2. Начните общение

  1. Выберите модель из выпадающего списка на нижней панели
  2. Нажмите значок загрузки модели (модель загружается автоматически при первом сообщении, если ещё не загружена)
  3. Введите сообщение и нажмите Return, чтобы отправить
  4. ИИ отвечает в реальном времени, токен за токеном

Обзор интерфейса

Боковая панель

Переключайте значком гамбургера (вверху слева). Показывает ваши сеансы чата.

  • Нажмите на сеанс, чтобы переключиться на него
  • Щёлкните правой кнопкой для Rename или Delete
  • Нажмите + New Chat, чтобы начать новый разговор

Область чата

  • Ваши сообщения отображаются справа (цветные пузыри)
  • Ответы ИИ отображаются слева
  • Нажмите значок копирования у любого сообщения, чтобы скопировать его в буфер обмена
  • Нажмите Shift + Return для новой строки без отправки

Нижняя панель инструментов

ЭлементОписание
Выпадающий список моделейВыбор используемой модели
Значок загрузкиОткрывает Model Manager
Значок загрузить / выгрузитьЗагрузка или выгрузка текущей модели вручную
Метка статусаПоказывает “Generating…” во время ответа

Управление моделями

Открывается значком загрузки на панели инструментов.

  • Downloaded tab — Список всех моделей на вашем диске. Удалите модели, которые больше не нужны, чтобы освободить место.
  • Recommend tab — Подобранный список популярных моделей с загрузкой в один клик. Размер на диске показывается перед загрузкой.
  • Browse tab — Поиск напрямую на Hugging Face. Фильтр по имени и просмотр доступных GGUF-файлов в любом репозитории.

Где хранятся модели

OSПуть
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Настройки

Доступ через значок шестерёнки (внизу слева) или меню приложения.

НастройкаОписаниеПо умолчанию
TemperatureУровень креативности (0.0 = сфокусированный, 1.0+ = креативный)0.7
Max TokensМаксимальная длина ответа512
Context SizeСколько истории разговора видит модель2048
System PromptИнструкции, передаваемые модели перед каждым разговором“You are a helpful assistant.”
API EnabledЗапускает локальный REST API-серверOn
API PortНомер порта для API-сервера8800

Выбор правильных настроек

  • Temperature — Ниже (0.1–0.3) для фактических ответов. Выше (0.7–1.0) для творческого письма.
  • Max Tokens — Увеличьте для более длинных ответов. 512 подходит для большинства разговоров.
  • Context Size — Большие значения позволяют модели помнить больше из разговора, но требуют больше RAM.

REST API

DeskLLM запускает локальный API-сервер, совместимый с форматом OpenAI. Другие приложения на вашем компьютере могут его использовать.

Endpoint: http://localhost:8800

Пример (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Пример (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Сочетания клавиш

ДействиеmacOSWindows
Показать / скрыть окноCtrl + Cmd + F8Ctrl + Alt + F8
Отправить сообщениеReturnReturn
Новая строкаShift + ReturnShift + Return
Новый чатCmd + NCtrl + N

Советы

  • Меняйте модели свободно — Вы можете менять модели в середине разговора в любой момент.
  • System prompt — Настройте его под разные сценарии: переводчик, помощник по программированию, помощник для письма и т. д.
  • Несколько сеансов — Ведите отдельные разговоры по разным темам. Боковая панель упрощает переключение.
  • Использование офлайн — После загрузки модели DeskLLM работает полностью офлайн.
  • Интеграция API — Используйте встроенный API, чтобы соединить DeskLLM с другими инструментами, скриптами или приложениями на вашей машине.

Устранение неполадок

ПроблемаРешение
Модель не загружаетсяПроверьте доступную RAM. Меньшая квантизация (Q4_K_M) использует меньше памяти.
Медленные ответыПопробуйте модель меньшего размера. Закройте другие ресурсоёмкие приложения.
Невнятный выводПонизьте температуру. Попробуйте другую модель.
Сбой загрузкиПроверьте интернет-соединение. Попробуйте снова — загрузки возобновляются автоматически.
Приложение не запускаетсяУдалите файл настроек и перезапустите.

Конфиденциальность

  • Вся обработка ИИ происходит локально на вашем компьютере
  • Никакие данные не отправляются на внешние серверы
  • История чата хранится только на вашем локальном диске
  • Модели загружаются с Hugging Face (единственный сетевой доступ)