Mengobrol dengan model AI yang berjalan sepenuhnya di desktop Anda. Tidak perlu internet, tidak ada data yang meninggalkan perangkat Anda.
Memulai
1. Unduh Model
DeskLLM membutuhkan model bahasa untuk bekerja. Pada peluncuran pertama, klik ikon unduh di bilah alat bawah untuk membuka Model Manager.
Recommend tab — Pilih model yang sesuai dengan komputer Anda:
| Kategori | RAM | Terbaik untuk |
|---|---|---|
| Ultra Light | 4 GB+ | Jawaban cepat, sumber daya minimal |
| Light | 8 GB+ | Tugas sehari-hari, asisten latar belakang |
| Standard | 16 GB+ | Obrolan, penulisan, ringkasan |
| High-End | 32 GB+ | Penalaran kompleks, pembuatan kode |
Klik Download pada kartu model mana saja. Kemajuan unduhan ditampilkan secara real time.
Browse tab — Cari Hugging Face untuk model GGUF apa pun berdasarkan kata kunci.
2. Mulai Mengobrol
- Pilih model dari menu dropdown di bilah alat bawah
- Klik ikon muat (model dimuat secara otomatis pada pesan pertama jika belum dimuat)
- Ketik pesan Anda dan tekan Return untuk mengirim
- AI merespons secara real time, token demi token
Ikhtisar Antarmuka
Bilah Sisi
Alihkan dengan ikon hamburger (kiri atas). Menampilkan sesi obrolan Anda.
- Klik sesi untuk beralih ke sesi tersebut
- Klik kanan untuk memilih Rename atau Delete
- Klik + New Chat untuk memulai percakapan baru
Area Obrolan
- Pesan Anda muncul di sebelah kanan (gelembung berwarna)
- Respons AI muncul di sebelah kiri
- Klik ikon salin pada pesan apa pun untuk menyalinnya ke clipboard
- Tekan Shift + Return untuk baris baru tanpa mengirim
Bilah Alat Bawah
| Elemen | Deskripsi |
|---|---|
| Model dropdown | Pilih model yang akan digunakan |
| Download icon | Buka Model Manager |
| Load / Unload icon | Muat atau bongkar model saat ini secara manual |
| Status label | Menampilkan “Generating…” selama respons |
Manajemen Model
Buka dengan ikon unduh di bilah alat.
- Downloaded tab — Mencantumkan semua model di disk Anda. Hapus model yang tidak Anda perlukan lagi untuk membebaskan ruang.
- Recommend tab — Daftar pilihan model populer dengan unduhan satu klik. Ruang disk ditampilkan sebelum pengunduhan.
- Browse tab — Cari langsung di Hugging Face. Filter berdasarkan nama dan jelajahi file GGUF yang tersedia untuk repository mana pun.
Tempat Model Disimpan
| OS | Path |
|---|---|
| macOS | ~/Library/Application Support/DeskAssist/llm_models/ |
| Windows | %APPDATA%/DeskAssist/llm_models/ |
Pengaturan
Akses dari ikon roda gigi (kiri bawah) atau menu aplikasi.
| Pengaturan | Deskripsi | Default |
|---|---|---|
| Temperature | Tingkat kreativitas (0.0 = fokus, 1.0+ = kreatif) | 0.7 |
| Max Tokens | Panjang respons maksimum | 512 |
| Context Size | Berapa banyak riwayat percakapan yang dilihat model | 2048 |
| System Prompt | Instruksi yang diberikan kepada model sebelum setiap percakapan | “You are a helpful assistant.” |
| API Enabled | Mulai server REST API lokal | On |
| API Port | Nomor port untuk server API | 8800 |
Memilih Pengaturan yang Tepat
- Temperature — Lebih rendah (0.1–0.3) untuk jawaban faktual. Lebih tinggi (0.7–1.0) untuk penulisan kreatif.
- Max Tokens — Tingkatkan untuk respons yang lebih panjang. 512 cocok untuk sebagian besar percakapan.
- Context Size — Nilai yang lebih besar memungkinkan model mengingat lebih banyak percakapan, tetapi menggunakan lebih banyak RAM.
REST API
DeskLLM menjalankan server API lokal yang kompatibel dengan format OpenAI. Aplikasi lain di komputer Anda dapat menggunakannya.
Endpoint: http://localhost:8800
Contoh (curl)
curl http://localhost:8800/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"messages": [{"role": "user", "content": "Hello!"}],
"stream": true
}'
Contoh (Python)
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
model="local",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)
Pintasan Keyboard
| Tindakan | macOS | Windows |
|---|---|---|
| Tampilkan / sembunyikan jendela | Ctrl + Cmd + F8 | Ctrl + Alt + F8 |
| Kirim pesan | Return | Return |
| Baris baru | Shift + Return | Shift + Return |
| Obrolan baru | Cmd + N | Ctrl + N |
Tips
- Beralih model dengan bebas — Anda dapat mengubah model di tengah percakapan kapan saja.
- System prompt — Sesuaikan untuk berbagai kasus penggunaan: penerjemah, asisten coding, pembantu menulis, dll.
- Beberapa sesi — Pisahkan percakapan untuk topik yang berbeda. Bilah sisi memudahkan untuk beralih.
- Penggunaan offline — Setelah model diunduh, DeskLLM bekerja sepenuhnya offline.
- Integrasi API — Gunakan API bawaan untuk menghubungkan DeskLLM dengan alat, skrip, atau aplikasi lain di mesin Anda.
Pemecahan Masalah
| Masalah | Solusi |
|---|---|
| Model tidak mau dimuat | Periksa RAM yang tersedia. Kuantisasi yang lebih kecil (Q4_K_M) menggunakan lebih sedikit memori. |
| Respons lambat | Coba model yang lebih kecil. Tutup aplikasi lain yang menggunakan banyak memori. |
| Output kacau | Turunkan suhu. Coba model yang berbeda. |
| Pengunduhan gagal | Periksa koneksi internet. Coba lagi — pengunduhan dilanjutkan secara otomatis. |
| Aplikasi tidak mau dimulai | Hapus file pengaturan dan jalankan ulang. |
Privasi
- Semua pemrosesan AI terjadi secara lokal di komputer Anda
- Tidak ada data yang dikirim ke server eksternal mana pun
- Riwayat obrolan disimpan hanya di disk lokal Anda
- Model diunduh dari Hugging Face (satu-satunya akses jaringan)