DeskLLM - Panduan

Bersembang dengan model AI yang berjalan sepenuhnya pada desktop anda. Tidak memerlukan internet, tiada data meninggalkan peranti anda.


Bermula

1. Muat Turun Model

DeskLLM memerlukan model bahasa untuk berfungsi. Pada pelancaran pertama, klik ikon muat turun di bar alat bawah untuk membuka Model Manager.

Recommend tab — Pilih model yang sesuai dengan komputer anda:

KategoriRAMTerbaik untuk
Ultra Light4 GB+Jawapan pantas, sumber minimum
Light8 GB+Tugasan harian, pembantu latar belakang
Standard16 GB+Sembang, penulisan, ringkasan
High-End32 GB+Penaakulan kompleks, penjanaan kod

Klik Download pada mana-mana kad model. Kemajuan muat turun ditunjukkan dalam masa nyata.

Browse tab — Cari Hugging Face untuk mana-mana model GGUF mengikut kata kunci.

2. Mula Bersembang

  1. Pilih model dari menu lungsur turun di bar alat bawah
  2. Klik ikon muat (model dimuat secara automatik pada mesej pertama jika belum dimuat)
  3. Taipkan mesej anda dan tekan Return untuk menghantar
  4. AI bertindak balas dalam masa nyata, token demi token

Gambaran Antara Muka

Bar Sisi

Togol dengan ikon hamburger (kiri atas). Memaparkan sesi sembang anda.

  • Klik sesi untuk beralih kepadanya
  • Klik kanan untuk memilih Rename atau Delete
  • Klik + New Chat untuk memulakan perbualan baharu

Kawasan Sembang

  • Mesej anda muncul di sebelah kanan (gelembung berwarna)
  • Respons AI muncul di sebelah kiri
  • Klik ikon salin pada mana-mana mesej untuk menyalinnya ke papan klip
  • Tekan Shift + Return untuk baris baharu tanpa menghantar

Bar Alat Bawah

ElemenPenerangan
Model dropdownPilih model yang akan digunakan
Download iconBuka Model Manager
Load / Unload iconMuat atau buang muatan model semasa secara manual
Status labelMemaparkan “Generating…” semasa respons

Pengurusan Model

Buka dengan ikon muat turun di bar alat.

  • Downloaded tab — Menyenaraikan semua model pada cakera anda. Padamkan model yang anda tidak perlukan lagi untuk membebaskan ruang.
  • Recommend tab — Senarai pilihan model popular dengan muat turun satu klik. Ruang cakera ditunjukkan sebelum memuat turun.
  • Browse tab — Cari terus di Hugging Face. Tapis mengikut nama dan layari fail GGUF yang tersedia untuk mana-mana repository.

Tempat Model Disimpan

OSLaluan
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Tetapan

Akses dari ikon roda gear (kiri bawah) atau menu aplikasi.

TetapanPeneranganLalai
TemperatureTahap kreativiti (0.0 = fokus, 1.0+ = kreatif)0.7
Max TokensPanjang maksimum respons512
Context SizeBerapa banyak sejarah perbualan yang dilihat oleh model2048
System PromptArahan yang diberikan kepada model sebelum setiap perbualan“You are a helpful assistant.”
API EnabledMulakan pelayan REST API tempatanOn
API PortNombor port untuk pelayan API8800

Memilih Tetapan yang Betul

  • Temperature — Lebih rendah (0.1–0.3) untuk jawapan fakta. Lebih tinggi (0.7–1.0) untuk penulisan kreatif.
  • Max Tokens — Tingkatkan untuk respons yang lebih panjang. 512 sesuai untuk kebanyakan perbualan.
  • Context Size — Nilai yang lebih besar membolehkan model mengingati lebih banyak perbualan, tetapi menggunakan lebih banyak RAM.

REST API

DeskLLM menjalankan pelayan API tempatan yang serasi dengan format OpenAI. Aplikasi lain pada komputer anda boleh menggunakannya.

Endpoint: http://localhost:8800

Contoh (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Contoh (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Pintasan Papan Kekunci

TindakanmacOSWindows
Tunjuk / sembunyi tetingkapCtrl + Cmd + F8Ctrl + Alt + F8
Hantar mesejReturnReturn
Baris baharuShift + ReturnShift + Return
Sembang baharuCmd + NCtrl + N

Petua

  • Tukar model dengan bebas — Anda boleh menukar model di tengah-tengah perbualan pada bila-bila masa.
  • System prompt — Sesuaikan untuk pelbagai kes penggunaan: penterjemah, pembantu pengekodan, pembantu menulis, dll.
  • Berbilang sesi — Asingkan perbualan untuk topik berbeza. Bar sisi memudahkan untuk beralih.
  • Penggunaan luar talian — Setelah model dimuat turun, DeskLLM berfungsi sepenuhnya luar talian.
  • Integrasi API — Gunakan API terbina dalam untuk menyambungkan DeskLLM dengan alat, skrip atau aplikasi lain pada mesin anda.

Penyelesaian Masalah

IsuPenyelesaian
Model tidak mahu dimuatSemak RAM yang tersedia. Pengkuantitian yang lebih kecil (Q4_K_M) menggunakan kurang memori.
Respons perlahanCuba model yang lebih kecil. Tutup aplikasi lain yang banyak menggunakan memori.
Output bercelaruTurunkan suhu. Cuba model yang berbeza.
Muat turun gagalSemak sambungan internet. Cuba lagi — muat turun disambung semula secara automatik.
Aplikasi tidak mahu dimulakanPadam fail tetapan dan lancarkan semula.

Privasi

  • Semua pemprosesan AI berlaku secara tempatan pada komputer anda
  • Tiada data dihantar ke mana-mana pelayan luar
  • Sejarah sembang disimpan hanya pada cakera tempatan anda
  • Model dimuat turun dari Hugging Face (satu-satunya akses rangkaian)