DeskLLM - Guide

Discutez avec des modèles dIA s’exécutant entièrement sur votre bureau. Aucune connexion internet requise, aucune donnée ne quitte votre appareil.


Pour Commencer

1. Télécharger un Modèle

DeskLLM a besoin d’un modèle de langage pour fonctionner. Au premier lancement, cliquez sur l’icône de téléchargement dans la barre d’outils du bas pour ouvrir le Model Manager.

Recommend tab — Choisissez un modèle adapté à votre ordinateur :

CatégorieRAMIdéal pour
Ultra Light4 GB+Réponses rapides, ressources minimales
Light8 GB+Tâches quotidiennes, assistant en arrière-plan
Standard16 GB+Chat, rédaction, résumé
High-End32 GB+Raisonnement complexe, génération de code

Cliquez sur Download sur n’importe quelle carte de modèle. La progression du téléchargement est affichée en temps réel.

Browse tab — Recherchez n’importe quel modèle GGUF sur Hugging Face par mot-clé.

2. Commencer à Discuter

  1. Sélectionnez un modèle dans le menu déroulant de la barre du bas
  2. Cliquez sur l’icône de chargement (le modèle se charge automatiquement au premier message s’il n’est pas chargé)
  3. Saisissez votre message et appuyez sur Return pour envoyer
  4. L IA répond en temps réel, token par token

Aperçu de l’Interface

Barre Latérale

Activez-la avec l’icône hamburger (en haut à gauche). Affiche vos sessions de chat.

  • Cliquez sur une session pour y basculer
  • Faites un clic droit pour Rename ou Delete
  • Cliquez sur + New Chat pour démarrer une nouvelle conversation

Zone de Chat

  • Vos messages apparaissent à droite (bulles colorées)
  • Les réponses de l’IA apparaissent à gauche
  • Cliquez sur l’icône de copie d’un message pour le copier dans le presse-papiers
  • Appuyez sur Shift + Return pour aller à la ligne sans envoyer

Barre d Outils du Bas

ÉlémentDescription
Menu déroulant des modèlesSélectionne le modèle à utiliser
Icône de téléchargementOuvre le Model Manager
Icône charger / déchargerCharge ou décharge manuellement le modèle actuel
Étiquette de statutAffiche “Generating…” pendant la réponse

Gestion des Modèles

Ouvrez avec l’icône de téléchargement de la barre d’outils.

  • Downloaded tab — Liste tous les modèles présents sur votre disque. Supprimez les modèles dont vous n’avez plus besoin pour libérer de l’espace.
  • Recommend tab — Liste sélectionnée de modèles populaires avec téléchargement en un clic. L espace disque est indiqué avant le téléchargement.
  • Browse tab — Recherchez directement sur Hugging Face. Filtrez par nom et parcourez les fichiers GGUF disponibles pour n’importe quel dépôt.

Où Sont Stockés les Modèles

OSChemin
macOS~/Library/Application Support/DeskAssist/llm_models/
Windows%APPDATA%/DeskAssist/llm_models/

Paramètres

Accédez-y via l’icône d’engrenage (en bas à gauche) ou le menu de l’application.

ParamètreDescriptionPar défaut
TemperatureNiveau de créativité (0.0 = ciblé, 1.0+ = créatif)0.7
Max TokensLongueur maximale de la réponse512
Context SizeQuantité d’historique de conversation que voit le modèle2048
System PromptInstructions données au modèle avant chaque conversation“You are a helpful assistant.”
API EnabledDémarre un serveur REST API localOn
API PortNuméro de port du serveur API8800

Choisir les Bons Paramètres

  • Temperature — Plus bas (0.1–0.3) pour des réponses factuelles. Plus haut (0.7–1.0) pour de l’écriture créative.
  • Max Tokens — Augmentez pour des réponses plus longues. 512 convient à la plupart des conversations.
  • Context Size — Des valeurs plus grandes permettent au modèle de se souvenir de plus de la conversation, mais utilisent plus de RAM.

REST API

DeskLLM exécute un serveur API local compatible avec le format OpenAI. D’autres applications de votre ordinateur peuvent l’utiliser.

Endpoint : http://localhost:8800

Exemple (curl)

curl http://localhost:8800/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "messages": [{"role": "user", "content": "Hello!"}],
    "stream": true
  }'

Exemple (Python)

from openai import OpenAI

client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
    model="local",
    messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)

Raccourcis Clavier

ActionmacOSWindows
Afficher / Masquer la fenêtreCtrl + Cmd + F8Ctrl + Alt + F8
Envoyer le messageReturnReturn
Nouvelle ligneShift + ReturnShift + Return
Nouveau chatCmd + NCtrl + N

Astuces

  • Changez de modèle librement — Vous pouvez changer de modèle en cours de conversation à tout moment.
  • System prompt — Personnalisez-le pour différents cas d’usage : traducteur, assistant de programmation, aide à la rédaction, etc.
  • Sessions multiples — Gardez des conversations séparées pour différents sujets. La barre latérale facilite le passage de l’une à l’autre.
  • Utilisation hors ligne — Une fois un modèle téléchargé, DeskLLM fonctionne entièrement hors ligne.
  • Intégration de l’API — Utilisez l’API intégrée pour connecter DeskLLM à d’autres outils, scripts ou applications de votre machine.

Dépannage

ProblèmeSolution
Le modèle ne se charge pasVérifiez la RAM disponible. Une quantification plus petite (Q4_K_M) utilise moins de mémoire.
Réponses lentesEssayez un modèle plus petit. Fermez les autres applications gourmandes en mémoire.
Sortie incohérenteDiminuez la température. Essayez un autre modèle.
Échec du téléchargementVérifiez la connexion internet. Réessayez — les téléchargements reprennent automatiquement.
L’app ne démarre pasSupprimez le fichier de paramètres et relancez.

Confidentialité

  • Tous les traitements d’IA se font localement sur votre ordinateur
  • Aucune donnée n’est envoyée à un serveur externe
  • L’historique de chat est stocké uniquement sur votre disque local
  • Les modèles sont téléchargés depuis Hugging Face (le seul accès réseau)