Bersembang dengan model AI yang berjalan sepenuhnya pada desktop anda. Tidak memerlukan internet, tiada data meninggalkan peranti anda.
Bermula
1. Muat Turun Model
DeskLLM memerlukan model bahasa untuk berfungsi. Pada pelancaran pertama, klik ikon muat turun di bar alat bawah untuk membuka Model Manager.
Recommend tab — Pilih model yang sesuai dengan komputer anda:
| Kategori | RAM | Terbaik untuk |
|---|---|---|
| Ultra Light | 4 GB+ | Jawapan pantas, sumber minimum |
| Light | 8 GB+ | Tugasan harian, pembantu latar belakang |
| Standard | 16 GB+ | Sembang, penulisan, ringkasan |
| High-End | 32 GB+ | Penaakulan kompleks, penjanaan kod |
Klik Download pada mana-mana kad model. Kemajuan muat turun ditunjukkan dalam masa nyata.
Browse tab — Cari Hugging Face untuk mana-mana model GGUF mengikut kata kunci.
2. Mula Bersembang
- Pilih model dari menu lungsur turun di bar alat bawah
- Klik ikon muat (model dimuat secara automatik pada mesej pertama jika belum dimuat)
- Taipkan mesej anda dan tekan Return untuk menghantar
- AI bertindak balas dalam masa nyata, token demi token
Gambaran Antara Muka
Bar Sisi
Togol dengan ikon hamburger (kiri atas). Memaparkan sesi sembang anda.
- Klik sesi untuk beralih kepadanya
- Klik kanan untuk memilih Rename atau Delete
- Klik + New Chat untuk memulakan perbualan baharu
Kawasan Sembang
- Mesej anda muncul di sebelah kanan (gelembung berwarna)
- Respons AI muncul di sebelah kiri
- Klik ikon salin pada mana-mana mesej untuk menyalinnya ke papan klip
- Tekan Shift + Return untuk baris baharu tanpa menghantar
Bar Alat Bawah
| Elemen | Penerangan |
|---|---|
| Model dropdown | Pilih model yang akan digunakan |
| Download icon | Buka Model Manager |
| Load / Unload icon | Muat atau buang muatan model semasa secara manual |
| Status label | Memaparkan “Generating…” semasa respons |
Pengurusan Model
Buka dengan ikon muat turun di bar alat.
- Downloaded tab — Menyenaraikan semua model pada cakera anda. Padamkan model yang anda tidak perlukan lagi untuk membebaskan ruang.
- Recommend tab — Senarai pilihan model popular dengan muat turun satu klik. Ruang cakera ditunjukkan sebelum memuat turun.
- Browse tab — Cari terus di Hugging Face. Tapis mengikut nama dan layari fail GGUF yang tersedia untuk mana-mana repository.
Tempat Model Disimpan
| OS | Laluan |
|---|---|
| macOS | ~/Library/Application Support/DeskAssist/llm_models/ |
| Windows | %APPDATA%/DeskAssist/llm_models/ |
Tetapan
Akses dari ikon roda gear (kiri bawah) atau menu aplikasi.
| Tetapan | Penerangan | Lalai |
|---|---|---|
| Temperature | Tahap kreativiti (0.0 = fokus, 1.0+ = kreatif) | 0.7 |
| Max Tokens | Panjang maksimum respons | 512 |
| Context Size | Berapa banyak sejarah perbualan yang dilihat oleh model | 2048 |
| System Prompt | Arahan yang diberikan kepada model sebelum setiap perbualan | “You are a helpful assistant.” |
| API Enabled | Mulakan pelayan REST API tempatan | On |
| API Port | Nombor port untuk pelayan API | 8800 |
Memilih Tetapan yang Betul
- Temperature — Lebih rendah (0.1–0.3) untuk jawapan fakta. Lebih tinggi (0.7–1.0) untuk penulisan kreatif.
- Max Tokens — Tingkatkan untuk respons yang lebih panjang. 512 sesuai untuk kebanyakan perbualan.
- Context Size — Nilai yang lebih besar membolehkan model mengingati lebih banyak perbualan, tetapi menggunakan lebih banyak RAM.
REST API
DeskLLM menjalankan pelayan API tempatan yang serasi dengan format OpenAI. Aplikasi lain pada komputer anda boleh menggunakannya.
Endpoint: http://localhost:8800
Contoh (curl)
curl http://localhost:8800/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"messages": [{"role": "user", "content": "Hello!"}],
"stream": true
}'
Contoh (Python)
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
model="local",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)
Pintasan Papan Kekunci
| Tindakan | macOS | Windows |
|---|---|---|
| Tunjuk / sembunyi tetingkap | Ctrl + Cmd + F8 | Ctrl + Alt + F8 |
| Hantar mesej | Return | Return |
| Baris baharu | Shift + Return | Shift + Return |
| Sembang baharu | Cmd + N | Ctrl + N |
Petua
- Tukar model dengan bebas — Anda boleh menukar model di tengah-tengah perbualan pada bila-bila masa.
- System prompt — Sesuaikan untuk pelbagai kes penggunaan: penterjemah, pembantu pengekodan, pembantu menulis, dll.
- Berbilang sesi — Asingkan perbualan untuk topik berbeza. Bar sisi memudahkan untuk beralih.
- Penggunaan luar talian — Setelah model dimuat turun, DeskLLM berfungsi sepenuhnya luar talian.
- Integrasi API — Gunakan API terbina dalam untuk menyambungkan DeskLLM dengan alat, skrip atau aplikasi lain pada mesin anda.
Penyelesaian Masalah
| Isu | Penyelesaian |
|---|---|
| Model tidak mahu dimuat | Semak RAM yang tersedia. Pengkuantitian yang lebih kecil (Q4_K_M) menggunakan kurang memori. |
| Respons perlahan | Cuba model yang lebih kecil. Tutup aplikasi lain yang banyak menggunakan memori. |
| Output bercelaru | Turunkan suhu. Cuba model yang berbeza. |
| Muat turun gagal | Semak sambungan internet. Cuba lagi — muat turun disambung semula secara automatik. |
| Aplikasi tidak mahu dimulakan | Padam fail tetapan dan lancarkan semula. |
Privasi
- Semua pemprosesan AI berlaku secara tempatan pada komputer anda
- Tiada data dihantar ke mana-mana pelayan luar
- Sejarah sembang disimpan hanya pada cakera tempatan anda
- Model dimuat turun dari Hugging Face (satu-satunya akses rangkaian)