Discutez avec des modèles dIA s’exécutant entièrement sur votre bureau. Aucune connexion internet requise, aucune donnée ne quitte votre appareil.
Pour Commencer
1. Télécharger un Modèle
DeskLLM a besoin d’un modèle de langage pour fonctionner. Au premier lancement, cliquez sur l’icône de téléchargement dans la barre d’outils du bas pour ouvrir le Model Manager.
Recommend tab — Choisissez un modèle adapté à votre ordinateur :
| Catégorie | RAM | Idéal pour |
|---|---|---|
| Ultra Light | 4 GB+ | Réponses rapides, ressources minimales |
| Light | 8 GB+ | Tâches quotidiennes, assistant en arrière-plan |
| Standard | 16 GB+ | Chat, rédaction, résumé |
| High-End | 32 GB+ | Raisonnement complexe, génération de code |
Cliquez sur Download sur n’importe quelle carte de modèle. La progression du téléchargement est affichée en temps réel.
Browse tab — Recherchez n’importe quel modèle GGUF sur Hugging Face par mot-clé.
2. Commencer à Discuter
- Sélectionnez un modèle dans le menu déroulant de la barre du bas
- Cliquez sur l’icône de chargement (le modèle se charge automatiquement au premier message s’il n’est pas chargé)
- Saisissez votre message et appuyez sur Return pour envoyer
- L IA répond en temps réel, token par token
Aperçu de l’Interface
Barre Latérale
Activez-la avec l’icône hamburger (en haut à gauche). Affiche vos sessions de chat.
- Cliquez sur une session pour y basculer
- Faites un clic droit pour Rename ou Delete
- Cliquez sur + New Chat pour démarrer une nouvelle conversation
Zone de Chat
- Vos messages apparaissent à droite (bulles colorées)
- Les réponses de l’IA apparaissent à gauche
- Cliquez sur l’icône de copie d’un message pour le copier dans le presse-papiers
- Appuyez sur Shift + Return pour aller à la ligne sans envoyer
Barre d Outils du Bas
| Élément | Description |
|---|---|
| Menu déroulant des modèles | Sélectionne le modèle à utiliser |
| Icône de téléchargement | Ouvre le Model Manager |
| Icône charger / décharger | Charge ou décharge manuellement le modèle actuel |
| Étiquette de statut | Affiche “Generating…” pendant la réponse |
Gestion des Modèles
Ouvrez avec l’icône de téléchargement de la barre d’outils.
- Downloaded tab — Liste tous les modèles présents sur votre disque. Supprimez les modèles dont vous n’avez plus besoin pour libérer de l’espace.
- Recommend tab — Liste sélectionnée de modèles populaires avec téléchargement en un clic. L espace disque est indiqué avant le téléchargement.
- Browse tab — Recherchez directement sur Hugging Face. Filtrez par nom et parcourez les fichiers GGUF disponibles pour n’importe quel dépôt.
Où Sont Stockés les Modèles
| OS | Chemin |
|---|---|
| macOS | ~/Library/Application Support/DeskAssist/llm_models/ |
| Windows | %APPDATA%/DeskAssist/llm_models/ |
Paramètres
Accédez-y via l’icône d’engrenage (en bas à gauche) ou le menu de l’application.
| Paramètre | Description | Par défaut |
|---|---|---|
| Temperature | Niveau de créativité (0.0 = ciblé, 1.0+ = créatif) | 0.7 |
| Max Tokens | Longueur maximale de la réponse | 512 |
| Context Size | Quantité d’historique de conversation que voit le modèle | 2048 |
| System Prompt | Instructions données au modèle avant chaque conversation | “You are a helpful assistant.” |
| API Enabled | Démarre un serveur REST API local | On |
| API Port | Numéro de port du serveur API | 8800 |
Choisir les Bons Paramètres
- Temperature — Plus bas (0.1–0.3) pour des réponses factuelles. Plus haut (0.7–1.0) pour de l’écriture créative.
- Max Tokens — Augmentez pour des réponses plus longues. 512 convient à la plupart des conversations.
- Context Size — Des valeurs plus grandes permettent au modèle de se souvenir de plus de la conversation, mais utilisent plus de RAM.
REST API
DeskLLM exécute un serveur API local compatible avec le format OpenAI. D’autres applications de votre ordinateur peuvent l’utiliser.
Endpoint : http://localhost:8800
Exemple (curl)
curl http://localhost:8800/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"messages": [{"role": "user", "content": "Hello!"}],
"stream": true
}'
Exemple (Python)
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8800/v1", api_key="none")
response = client.chat.completions.create(
model="local",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)
Raccourcis Clavier
| Action | macOS | Windows |
|---|---|---|
| Afficher / Masquer la fenêtre | Ctrl + Cmd + F8 | Ctrl + Alt + F8 |
| Envoyer le message | Return | Return |
| Nouvelle ligne | Shift + Return | Shift + Return |
| Nouveau chat | Cmd + N | Ctrl + N |
Astuces
- Changez de modèle librement — Vous pouvez changer de modèle en cours de conversation à tout moment.
- System prompt — Personnalisez-le pour différents cas d’usage : traducteur, assistant de programmation, aide à la rédaction, etc.
- Sessions multiples — Gardez des conversations séparées pour différents sujets. La barre latérale facilite le passage de l’une à l’autre.
- Utilisation hors ligne — Une fois un modèle téléchargé, DeskLLM fonctionne entièrement hors ligne.
- Intégration de l’API — Utilisez l’API intégrée pour connecter DeskLLM à d’autres outils, scripts ou applications de votre machine.
Dépannage
| Problème | Solution |
|---|---|
| Le modèle ne se charge pas | Vérifiez la RAM disponible. Une quantification plus petite (Q4_K_M) utilise moins de mémoire. |
| Réponses lentes | Essayez un modèle plus petit. Fermez les autres applications gourmandes en mémoire. |
| Sortie incohérente | Diminuez la température. Essayez un autre modèle. |
| Échec du téléchargement | Vérifiez la connexion internet. Réessayez — les téléchargements reprennent automatiquement. |
| L’app ne démarre pas | Supprimez le fichier de paramètres et relancez. |
Confidentialité
- Tous les traitements d’IA se font localement sur votre ordinateur
- Aucune donnée n’est envoyée à un serveur externe
- L’historique de chat est stocké uniquement sur votre disque local
- Les modèles sont téléchargés depuis Hugging Face (le seul accès réseau)