Guide d'utilisation de QuickLLM
QuickLLM garde l'inférence, les conversations, les documents, les embeddings, la recherche et le texte généré sur votre appareil, tout en rendant visibles l'adéquation des modèles et l'usage du réseau.
Premiers pas
- Lancez les diagnostics de l'appareil et choisissez un modèle adapté.
- Téléchargez, vérifiez et chargez le modèle.
- Démarrez une conversation et choisissez un profil.
- Vous pouvez aussi créer une base de connaissances, y ajouter des documents fiables et vérifier les citations.
- Exportez le travail important ou créez une sauvegarde chiffrée avant de déplacer ou de supprimer des données.
Présentation de l'interface
| Zone | Rôle |
|---|---|
| Chat | Liste des conversations, choix du modèle, du profil et des connaissances, messages, citations, contexte, Envoyer et Arrêter. |
| Modèles | Catalogue, recherche, compatibilité, téléchargements, fichiers installés, profils, adaptateurs et état d'exécution. |
| Connaissances | Bases de connaissances, documents, extraction, indexation, tests de recherche, ancrage et citations. |
| Templates & Actions | Prompts réutilisables, workflows typés, saisie par partage sur mobile, revue des résultats et chemins d'enregistrement. |
| Utilitaires | Diagnostics, téléchargements, API de bureau, sauvegarde/restauration, action rapide, réglages, aide, confidentialité et licences. |
Des modèles adaptés, des réponses traçables
QuickLLM distingue les capacités mesurées de l'appareil des simples estimations, et garde les réponses ancrées liées à des extraits de documents locaux au lieu d'inventer des citations sans fondement.
- Conversation locale et privée : Menez vos conversations via une inférence locale intégrée, avec un état visible du modèle, du profil, des connaissances, du contexte, de la génération et de l'arrêt.
- Adéquation des modèles : Mesurez les capacités de l'appareil, comparez les besoins en mémoire et en stockage, téléchargez des modèles vérifiés et comprenez pourquoi une configuration n'est pas prise en charge.
- Bases de connaissances : Importez les documents pris en charge, construisez des index locaux, récupérez des extraits sourcés et ouvrez les citations dans leur source.
- Profils et LoRA : Enregistrez des combinaisons de modèle, de contexte, d'échantillonnage, de moteur et d'adaptateur pour un travail reproductible.
- Templates et actions : Réutilisez des prompts privés et exécutez des workflows sur du texte partagé, avec des résultats disponibles pour la copie, le partage ou la conversation.
- Un contrôle portable : Exportez vos conversations, faites tourner une API locale sur ordinateur lorsque vous l'activez explicitement, et créez des fichiers de sauvegarde et de restauration chiffrés.
Réglages
Ouvrez les Réglages pour examiner les commandes propres à l'application suivantes :
- Moteur natif, backend, threads, contexte, cache, stockage et préférences de modèle
- Extraction des connaissances, embeddings, recherche, ancrage et comportement des citations
- API locale sur ordinateur, réseau, partage mobile, templates et actions
- Confidentialité, sauvegarde chiffrée, suppression, apparence, raccourcis, diagnostics et licences
L'essai, Free et Pro proposent le même ensemble fonctionnel. Pro supprime les publicités sur mobile et le rappel de soutien quotidien sur ordinateur.
Raccourcis clavier
Sur les plateformes Apple, utilisez Command lorsque l'application associe au modificateur principal de la plateforme un raccourci affiché avec Ctrl. La page des raccourcis intégrée à l'application fait toujours foi.
| Raccourci | Action |
|---|---|
| Cmd/Ctrl + N | Nouvelle conversation |
| Cmd/Ctrl + K | Rechercher dans les conversations |
| Cmd/Ctrl + M | Choisir le modèle |
| Cmd/Ctrl + B | Choisir la base de connaissances |
| Cmd/Ctrl + Alt/Option + I | Détails de la conversation |
| Échap | Arrêter la génération |
Astuces & conseils
Dépannage
| Problème | À vérifier |
|---|---|
| Un modèle ne se charge pas | Vérifiez la compatibilité, l'estimation de mémoire, le stockage, la vérification du fichier, le backend sélectionné et l'existence d'une autre session de modèle active. |
| La génération est lente | Utilisez les diagnostics de l'appareil, un modèle ou un contexte plus petit, un backend adapté, et fiez-vous à des performances mesurées plutôt que supposées. |
| Les connaissances ne donnent aucune réponse | Vérifiez l'extraction des documents, l'état de l'index, le test de recherche, les filtres, et si la source contient réellement des éléments de réponse. |
| Une sauvegarde ne peut pas être restaurée | Vérifiez la phrase secrète, l'intégrité du fichier, la compatibilité du schéma, l'espace libre et la revue de restauration avant de remplacer les données actuelles. |
Confidentialité
- Les prompts, conversations, documents, embeddings, recherches et textes générés restent sur l'appareil.
- L'usage du réseau se limite aux consultations de catalogue ou de recherche demandées, au téléchargement de modèles, à la vérification des mises à jour ou à un point de terminaison d'API que vous activez explicitement.
- Les éléments partagés depuis mobile sont temporaires et les originaux externes ne sont jamais supprimés.
- Les données de l'espace de travail appartenant à l'app et les copies gérées peuvent être supprimées via le flux de confidentialité prévu à cet effet.