DeskLLM - 指南

与完全运行在您桌面上的 AI 模型聊天。无需联网,数据不会离开您的设备。


入门

1. 下载模型

DeskLLM 需要语言模型才能工作。首次启动时,单击底部工具栏中的下载图标以打开 Model Manager。

Recommend tab — 选择适合您电脑的模型:

类别RAM最适合
Ultra Light4 GB+快速回答,资源占用最少
Light8 GB+日常任务,后台助手
Standard16 GB+聊天、写作、摘要
High-End32 GB+复杂推理、代码生成

在任何模型卡片上单击 Download。下载进度会实时显示。

Browse tab — 通过关键字在 Hugging Face 上搜索任何 GGUF 模型。

2. 开始聊天

  1. 在底部工具栏的下拉菜单中选择一个模型
  2. 单击加载图标(如果未加载,则在首次发送消息时自动加载)
  3. 输入消息并按 Return 发送
  4. AI 会逐个 token 实时响应

界面概览

侧边栏

使用左上角的汉堡图标切换。显示您的聊天会话。

  • 单击会话以切换
  • 右键单击以 RenameDelete
  • 单击 + New Chat 开始新对话

聊天区

  • 您的消息 显示在右侧(彩色气泡)
  • AI 响应 显示在左侧
  • 单击任何消息上的复制图标将其复制到剪贴板
  • Shift + Return 换行而不发送

底部工具栏

元素描述
模型下拉菜单选择要使用的模型
下载图标打开 Model Manager
加载 / 卸载图标手动加载或卸载当前模型
状态标签响应期间显示 “Generating…”

模型管理

使用工具栏中的下载图标打开。

  • Downloaded tab — 列出磁盘上的所有模型。删除不再需要的模型以释放空间。
  • Recommend tab — 精选的热门模型列表,可一键下载。下载前显示磁盘空间。
  • Browse tab — 直接搜索 Hugging Face。按名称过滤并浏览任何仓库可用的 GGUF 文件。

模型存储位置

OS路径
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

设置

从左下角的齿轮图标或应用菜单访问。

设置描述默认值
Temperature创造性级别(0.0 = 专注,1.0+ = 创造性)0.7
Max Tokens最大响应长度512
Context Size模型可见的对话历史量2048
System Prompt每次对话前给模型的指令“You are a helpful assistant.”
API Enabled启动本地 REST API 服务器On
API PortAPI 服务器的端口号8800

选择合适的设置

  • Temperature — 较低(0.1–0.3)适合事实性回答。较高(0.7–1.0)适合创意写作。
  • Max Tokens — 增加以获得更长的响应。512 适合大多数对话。
  • Context Size — 较大的值让模型记住更多对话内容,但占用更多 RAM。

REST API

DeskLLM 运行一个与 OpenAI 格式兼容的本地 API 服务器。您电脑上的其他应用可以使用它。

端点: http://localhost:8800

示例 (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

示例 (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

键盘快捷键

操作macOSWindows
显示 / 隐藏窗口Ctrl + Cmd + F8Ctrl + Alt + F8
发送消息ReturnReturn
换行Shift + ReturnShift + Return
新建聊天Cmd + NCtrl + N

提示

  • 自由切换模型 — 您可以在对话中随时更改模型。
  • 系统提示 — 针对不同用例自定义:翻译器、编码助手、写作助手等。
  • 多个会话 — 为不同主题保留单独的对话。侧边栏让切换变得容易。
  • 离线使用 — 模型下载后,DeskLLM 完全离线工作。
  • API 集成 — 使用内置 API 将 DeskLLM 与您机器上的其他工具、脚本或应用连接。

故障排除

问题解决方案
模型无法加载检查可用 RAM。较小的量化(Q4_K_M)使用较少内存。
响应缓慢尝试较小的模型。关闭其他占用内存的应用。
输出乱码降低 temperature。尝试不同的模型。
下载失败检查网络连接。再试一次 — 下载会自动恢复。
应用无法启动删除设置文件并重新启动。

隐私

  • 所有 AI 处理都在您的电脑上本地进行
  • 不会向任何外部服务器发送数据
  • 聊天历史仅存储在您的本地磁盘上
  • 模型从 Hugging Face 下载(唯一的网络访问)