DeskLLM - 指南

與完全在您桌面上執行的 AI 模型聊天。無需網路,資料不會離開您的裝置。


入門

1. 下載模型

DeskLLM 需要語言模型才能運作。首次啟動時,點擊底部工具列中的下載圖示以開啟 Model Manager。

Recommend tab — 選擇適合您電腦的模型:

類別RAM最適合
Ultra Light4 GB+快速回答,最少資源
Light8 GB+日常任務,背景助理
Standard16 GB+聊天、寫作、摘要
High-End32 GB+複雜推理、程式碼生成

在任何模型卡片上點擊 Download。下載進度會即時顯示。

Browse tab — 透過關鍵字在 Hugging Face 上搜尋任何 GGUF 模型。

2. 開始聊天

  1. 在底部工具列的下拉式選單中選擇模型
  2. 點擊載入圖示(如未載入,首次傳送訊息時會自動載入)
  3. 輸入您的訊息並按 Return 傳送
  4. AI 會逐個 token 即時回應

介面總覽

側邊欄

使用左上角的漢堡圖示切換。顯示您的聊天會話。

  • 點擊會話以切換
  • 右鍵點擊以 RenameDelete
  • 點擊 + New Chat 開始新對話

聊天區

  • 您的訊息 顯示在右側(彩色氣泡)
  • AI 回應 顯示在左側
  • 點擊任何訊息上的複製圖示以複製到剪貼簿
  • Shift + Return 換行而不傳送

底部工具列

元素描述
模型下拉式選單選擇要使用的模型
下載圖示開啟 Model Manager
載入 / 卸載圖示手動載入或卸載目前模型
狀態標籤回應期間顯示 “Generating…”

模型管理

使用工具列中的下載圖示開啟。

  • Downloaded tab — 列出磁碟上的所有模型。刪除不再需要的模型以釋放空間。
  • Recommend tab — 精選的熱門模型清單,可一鍵下載。下載前會顯示磁碟空間。
  • Browse tab — 直接搜尋 Hugging Face。依名稱篩選並瀏覽任何儲存庫可用的 GGUF 檔案。

模型儲存位置

OS路徑
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

設定

從左下角的齒輪圖示或應用程式選單存取。

設定描述預設值
Temperature創造性等級(0.0 = 專注,1.0+ = 創意)0.7
Max Tokens最大回應長度512
Context Size模型可見的對話歷史量2048
System Prompt每次對話前給予模型的指令“You are a helpful assistant.”
API Enabled啟動本地 REST API 伺服器On
API PortAPI 伺服器的連接埠號碼8800

選擇合適的設定

  • Temperature — 較低(0.1–0.3)適合事實性回答。較高(0.7–1.0)適合創意寫作。
  • Max Tokens — 增加以獲得更長的回應。512 適合大多數對話。
  • Context Size — 較大的值讓模型記住更多對話內容,但會使用更多 RAM。

REST API

DeskLLM 執行一個與 OpenAI 格式相容的本地 API 伺服器。您電腦上的其他應用程式可以使用它。

端點: http://localhost:8800

範例 (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

範例 (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

鍵盤快速鍵

動作macOSWindows
顯示 / 隱藏視窗Ctrl + Cmd + F8Ctrl + Alt + F8
傳送訊息ReturnReturn
換行Shift + ReturnShift + Return
新增聊天Cmd + NCtrl + N

提示

  • 自由切換模型 — 您可以在對話中隨時變更模型。
  • 系統提示 — 針對不同用途自訂:翻譯器、編碼助手、寫作助手等。
  • 多個會話 — 為不同主題保留分開的對話。側邊欄讓切換變得容易。
  • 離線使用 — 模型下載後,DeskLLM 完全離線運作。
  • API 整合 — 使用內建 API 將 DeskLLM 與您機器上的其他工具、腳本或應用程式連接。

疑難排解

問題解決方案
模型無法載入檢查可用 RAM。較小的量化(Q4_K_M)使用較少記憶體。
回應緩慢嘗試較小的模型。關閉其他佔用記憶體的應用程式。
輸出亂碼降低 temperature。嘗試不同的模型。
下載失敗檢查網路連線。再試一次 — 下載會自動恢復。
應用程式無法啟動刪除設定檔並重新啟動。

隱私

  • 所有 AI 處理皆在您的電腦上本地進行
  • 不會傳送資料到任何外部伺服器
  • 聊天記錄僅儲存在您的本機磁碟上
  • 模型從 Hugging Face 下載(唯一的網路存取)