DeskLLM - คู่มือ

แชทกับโมเดล AI ที่ทำงานบนเดสก์ท็อปของคุณทั้งหมด ไม่ต้องใช้อินเทอร์เน็ต ข้อมูลไม่ออกจากอุปกรณ์ของคุณ


เริ่มต้นใช้งาน

1. ดาวน์โหลดโมเดล

DeskLLM ต้องการโมเดลภาษาเพื่อทำงาน เมื่อเปิดใช้งานครั้งแรก ให้คลิกไอคอนดาวน์โหลดในแถบเครื่องมือด้านล่างเพื่อเปิด Model Manager

Recommend tab — เลือกโมเดลที่เหมาะกับคอมพิวเตอร์ของคุณ:

หมวดหมู่RAMเหมาะสำหรับ
Ultra Light4 GB+คำตอบรวดเร็ว ใช้ทรัพยากรน้อยที่สุด
Light8 GB+งานประจำวัน ผู้ช่วยเบื้องหลัง
Standard16 GB+แชท เขียน สรุป
High-End32 GB+ใช้เหตุผลซับซ้อน สร้างโค้ด

คลิก Download บนการ์ดโมเดลใดๆ ความคืบหน้าการดาวน์โหลดจะแสดงแบบเรียลไทม์

Browse tab — ค้นหาโมเดล GGUF ใดๆ บน Hugging Face ด้วยคำสำคัญ

2. เริ่มแชท

  1. เลือกโมเดลจากเมนูดรอปดาวน์ในแถบเครื่องมือด้านล่าง
  2. คลิกไอคอนโหลด (โมเดลจะโหลดอัตโนมัติเมื่อส่งข้อความครั้งแรกหากยังไม่ได้โหลด)
  3. พิมพ์ข้อความของคุณและกด Return เพื่อส่ง
  4. AI ตอบสนองแบบเรียลไทม์ ทีละโทเคน

ภาพรวมของอินเทอร์เฟซ

แถบด้านข้าง

สลับด้วยไอคอนแฮมเบอร์เกอร์ (มุมซ้ายบน) แสดงเซสชันแชทของคุณ

  • คลิกเซสชันเพื่อสลับไปยังเซสชันนั้น
  • คลิกขวาเพื่อ Rename หรือ Delete
  • คลิก + New Chat เพื่อเริ่มการสนทนาใหม่

พื้นที่แชท

  • ข้อความของคุณ ปรากฏที่ด้านขวา (ฟองอากาศมีสี)
  • คำตอบของ AI ปรากฏที่ด้านซ้าย
  • คลิกไอคอนคัดลอกบนข้อความใดๆ เพื่อคัดลอกไปยังคลิปบอร์ด
  • กด Shift + Return เพื่อขึ้นบรรทัดใหม่โดยไม่ต้องส่ง

แถบเครื่องมือด้านล่าง

องค์ประกอบคำอธิบาย
เมนูดรอปดาวน์โมเดลเลือกโมเดลที่จะใช้
ไอคอนดาวน์โหลดเปิด Model Manager
ไอคอนโหลด / ปลดโหลดโหลดหรือปลดโหลดโมเดลปัจจุบันด้วยตนเอง
ป้ายสถานะแสดง “Generating…” ระหว่างการตอบสนอง

การจัดการโมเดล

เปิดด้วยไอคอนดาวน์โหลดในแถบเครื่องมือ

  • Downloaded tab — แสดงรายการโมเดลทั้งหมดบนดิสก์ของคุณ ลบโมเดลที่ไม่ต้องการเพื่อเพิ่มพื้นที่
  • Recommend tab — รายการที่คัดสรรของโมเดลยอดนิยมพร้อมดาวน์โหลดด้วยคลิกเดียว แสดงพื้นที่ดิสก์ก่อนดาวน์โหลด
  • Browse tab — ค้นหา Hugging Face โดยตรง กรองตามชื่อและเรียกดูไฟล์ GGUF ที่มีอยู่สำหรับที่เก็บใดๆ

ตำแหน่งจัดเก็บโมเดล

OSเส้นทาง
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

การตั้งค่า

เข้าถึงจากไอคอนเฟือง (มุมซ้ายล่าง) หรือเมนูแอป

การตั้งค่าคำอธิบายค่าเริ่มต้น
Temperatureระดับความคิดสร้างสรรค์ (0.0 = มุ่งเน้น, 1.0+ = สร้างสรรค์)0.7
Max Tokensความยาวคำตอบสูงสุด512
Context Sizeปริมาณประวัติการสนทนาที่โมเดลเห็น2048
System Promptคำแนะนำที่ให้กับโมเดลก่อนการสนทนาทุกครั้ง“You are a helpful assistant.”
API Enabledเริ่มเซิร์ฟเวอร์ REST API ภายในเครื่องOn
API Portหมายเลขพอร์ตสำหรับเซิร์ฟเวอร์ API8800

การเลือกการตั้งค่าที่เหมาะสม

  • Temperature — ต่ำกว่า (0.1–0.3) สำหรับคำตอบที่อิงข้อเท็จจริง สูงกว่า (0.7–1.0) สำหรับการเขียนเชิงสร้างสรรค์
  • Max Tokens — เพิ่มเพื่อให้คำตอบยาวขึ้น 512 เหมาะสำหรับการสนทนาส่วนใหญ่
  • Context Size — ค่าที่มากขึ้นช่วยให้โมเดลจำการสนทนาได้มากขึ้น แต่ใช้ RAM มากขึ้น

REST API

DeskLLM รันเซิร์ฟเวอร์ API ภายในเครื่องที่เข้ากันได้กับรูปแบบ OpenAI แอปอื่นๆ บนคอมพิวเตอร์ของคุณสามารถใช้งานได้

เอนด์พอยต์: http://localhost:8800

ตัวอย่าง (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

ตัวอย่าง (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

ทางลัดคีย์บอร์ด

การกระทำmacOSWindows
แสดง / ซ่อนหน้าต่างCtrl + Cmd + F8Ctrl + Alt + F8
ส่งข้อความReturnReturn
บรรทัดใหม่Shift + ReturnShift + Return
แชทใหม่Cmd + NCtrl + N

เคล็ดลับ

  • สลับโมเดลได้อย่างอิสระ — คุณสามารถเปลี่ยนโมเดลกลางการสนทนาได้ทุกเมื่อ
  • System prompt — ปรับแต่งสำหรับกรณีการใช้งานที่แตกต่างกัน: ผู้แปล ผู้ช่วยเขียนโค้ด ผู้ช่วยเขียน เป็นต้น
  • เซสชันหลายรายการ — เก็บการสนทนาแยกกันสำหรับหัวข้อต่างๆ แถบด้านข้างทำให้สลับได้ง่าย
  • ใช้งานออฟไลน์ — เมื่อโมเดลถูกดาวน์โหลดแล้ว DeskLLM ทำงานออฟไลน์ได้อย่างสมบูรณ์
  • การรวม API — ใช้ API ในตัวเพื่อเชื่อมต่อ DeskLLM กับเครื่องมือ สคริปต์ หรือแอปอื่นๆ บนเครื่องของคุณ

การแก้ไขปัญหา

ปัญหาแนวทางแก้ไข
โมเดลโหลดไม่ได้ตรวจสอบ RAM ที่มีอยู่ การแบ่งปริมาณที่เล็กลง (Q4_K_M) ใช้หน่วยความจำน้อยกว่า
การตอบสนองช้าลองโมเดลที่เล็กกว่า ปิดแอปอื่นที่ใช้หน่วยความจำมาก
ผลลัพธ์เพี้ยนลด temperature ลองโมเดลอื่น
การดาวน์โหลดล้มเหลวตรวจสอบการเชื่อมต่ออินเทอร์เน็ต ลองอีกครั้ง — การดาวน์โหลดจะกลับมาทำงานต่ออัตโนมัติ
แอปไม่เริ่มทำงานลบไฟล์การตั้งค่าและเปิดใหม่

ความเป็นส่วนตัว

  • การประมวลผล AI ทั้งหมดเกิดขึ้นภายในเครื่องของคุณ
  • ไม่มีการส่งข้อมูลไปยังเซิร์ฟเวอร์ภายนอกใดๆ
  • ประวัติการแชทถูกจัดเก็บไว้บนดิสก์ในเครื่องของคุณเท่านั้น
  • โมเดลถูกดาวน์โหลดจาก Hugging Face (การเข้าถึงเครือข่ายเพียงอย่างเดียว)