QuickLLM - Guía

Guía del usuario de QuickLLM

QuickLLM mantiene la inferencia, las conversaciones, los documentos, los embeddings, la recuperación y el texto generado en su dispositivo, a la vez que deja claro qué modelos caben y para qué se usa la red.

Primeros pasos

  1. Ejecute los diagnósticos del dispositivo y elija un modelo que quepa.
  2. Descargue, verifique y cargue el modelo.
  3. Inicie una conversación y elija un Profile.
  4. Opcionalmente, cree una Knowledge Base, añada documentos de confianza y verifique las citas.
  5. Exporte el trabajo importante o cree una copia de seguridad cifrada antes de mover o eliminar datos.
Consejo: Elija un contexto o un modelo más pequeño antes de forzar una configuración que no cabe en la memoria.

Descripción de la interfaz

ÁreaFunción
ChatLista de conversaciones, selección de modelo/Profile/Knowledge, mensajes, citas, contexto, Enviar y Detener.
ModelosCatálogo, búsqueda, compatibilidad, descargas, archivos instalados, Profiles, adaptadores y estado de ejecución.
KnowledgeKnowledge Bases, documentos, extracción, indexación, pruebas de recuperación, fundamentación y citas.
Templates & ActionsPrompts reutilizables, flujos de trabajo tipados, entrada compartida en móvil, revisión de resultados y rutas de guardado.
UtilidadesDiagnósticos, descargas, API de escritorio, copia de seguridad/restauración, acción rápida, Ajustes, Ayuda, privacidad y licencias.

Modelos que encajan, respuestas que puede rastrear

QuickLLM distingue la capacidad medida del dispositivo de las estimaciones y mantiene las respuestas fundamentadas vinculadas a extractos de documentos locales, en lugar de inventar citas sin respaldo.

  • Chat privado local: Ejecute conversaciones mediante inferencia local integrada, con el modelo, el Profile, el Knowledge, el contexto, la generación y el estado de Detener siempre visibles.
  • Ajuste del modelo: Mida la capacidad del dispositivo, compare las necesidades de memoria y almacenamiento, descargue modelos verificados y comprenda por qué ciertas configuraciones no son compatibles.
  • Knowledge Bases: Incorpore documentos compatibles, cree índices locales, recupere extractos fundamentados y abra las citas en su origen.
  • Profiles y LoRA: Guarde combinaciones de modelo, contexto, muestreo, backend y adaptador para trabajar de forma repetible.
  • Templates y Actions: Reutilice prompts privados y ejecute flujos de trabajo con texto compartido que mantienen los resultados disponibles para copiar, compartir o continuar en una conversación.
  • Control portátil: Exporte conversaciones, ejecute una API local de escritorio cuando la habilite explícitamente y cree archivos cifrados de copia de seguridad y restauración.
Nota: Los modelos descargados y los documentos de origen pueden tener licencias y restricciones de uso propias. Revíselas antes de usarlos o redistribuirlos.

Ajustes

Abre los Ajustes para revisar los siguientes controles específicos de la aplicación:

  • Motor nativo, backend, hilos, contexto, caché, almacenamiento y preferencias de modelo
  • Extracción de conocimiento, embeddings, recuperación, fundamentación y comportamiento de las citas
  • API local de escritorio, red, contenido compartido en móvil, templates y actions
  • Privacidad, copia de seguridad cifrada, eliminación, apariencia, atajos, diagnósticos y licencias

Prueba, Free y Pro usan el mismo conjunto funcional de características. Pro elimina los anuncios en el móvil y el recordatorio diario de apoyo en el escritorio.

Atajos de teclado

En las plataformas de Apple, usa Command cuando la aplicación asigne al modificador principal de la plataforma un atajo que se muestra con Ctrl. La página de atajos dentro de la aplicación es siempre la referencia definitiva.

AtajoAcción
Cmd/Ctrl + NNueva conversación
Cmd/Ctrl + KBuscar conversaciones
Cmd/Ctrl + MElegir modelo
Cmd/Ctrl + BElegir Knowledge Base
Cmd/Ctrl + Alt/Option + IDetalles de la conversación
EscDetener la generación

Consejos & trucos

Elija un contexto o un modelo más pequeño antes de forzar una configuración que no cabe en la memoria.
Use fundamentación estricta cuando una respuesta deba ceñirse a las fuentes indexadas.
Abra las citas y compare el extracto extraído antes de confiar en una afirmación generada.
Guarde las frases de contraseña de la copia de seguridad por separado del archivo cifrado.

Resolución de problemas

ProblemaQué comprobar
Un modelo no se puede cargarCompruebe la compatibilidad, la estimación de memoria, el almacenamiento, la verificación del archivo, el backend seleccionado y si hay otra sesión de modelo activa.
La generación es lentaUse los diagnósticos del dispositivo, un modelo o contexto más pequeño, un backend adecuado y datos de rendimiento medidos en lugar de supuestos.
Knowledge no encuentra respuestaRevise la extracción del documento, el estado del índice, la prueba de recuperación, los filtros y si la fuente contiene realmente la evidencia.
Una copia de seguridad no se puede restaurarVerifique la frase de contraseña, la integridad del archivo, la compatibilidad del esquema, el espacio libre y la revisión de restauración antes de reemplazar los datos actuales.

Privacidad

  • Los prompts, las conversaciones, los documentos, los embeddings, la recuperación y el texto generado permanecen en el dispositivo.
  • El uso de la red se limita al catálogo o la búsqueda que solicite, a la descarga de modelos, a la comprobación de actualizaciones o a un endpoint de API que habilite explícitamente.
  • El contenido compartido en móvil es temporal y los originales externos nunca se eliminan.
  • Los datos del espacio de trabajo propiedad de la aplicación y las copias gestionadas pueden eliminarse mediante el flujo de privacidad revisado.
Tu responsabilidad: No exponga la API opcional de escritorio más allá de un límite de confianza ni use modelos y documentos en contra de sus licencias.