QuickLLM - Guia

Guia do usuário do QuickLLM

O QuickLLM mantém a inferência, as conversas, os documentos, os embeddings, a recuperação e o texto gerado no seu dispositivo, deixando visíveis a adequação do modelo e a finalidade de cada uso da rede.

Primeiros passos

  1. Execute o diagnóstico do dispositivo e escolha um modelo compatível com ele.
  2. Baixe, verifique e carregue o modelo.
  3. Inicie uma conversa e escolha um Perfil.
  4. Se quiser, crie uma Base de Conhecimento, adicione documentos confiáveis e verifique as citações.
  5. Exporte o trabalho importante ou crie um backup criptografado antes de mover ou excluir dados.
Dica: Escolha um contexto ou um modelo menor antes de forçar uma configuração que não cabe na memória.

Visão geral da interface

ÁreaFunção
ConversaLista de conversas, seleção de modelo/Perfil/Conhecimento, mensagens, citações, contexto, Enviar e Parar.
ModelosCatálogo, busca, compatibilidade, downloads, arquivos instalados, Perfis, adaptadores e estado de execução.
KnowledgeBases de Conhecimento, documentos, extração, indexação, testes de recuperação, embasamento e citações.
Modelos & AçõesPrompts reutilizáveis, fluxos tipados, entrada por compartilhamento no celular, revisão de resultados e caminhos de salvamento.
UtilitáriosDiagnósticos, downloads, API do desktop, backup/restauração, ação rápida, Configurações, Ajuda, privacidade e licenças.

Modelos que cabem, respostas que você consegue rastrear

O QuickLLM distingue a capacidade medida do dispositivo das estimativas e mantém as respostas embasadas ligadas a trechos de documentos locais, em vez de inventar citações sem respaldo.

  • Conversa local e privada: Converse por meio da inferência local integrada, com o modelo, o Perfil, o Conhecimento, o contexto, a geração e o estado de Parar sempre visíveis.
  • Adequação do modelo: Meça a capacidade do dispositivo, compare as necessidades de memória e armazenamento, baixe modelos verificados e entenda por que uma configuração não tem suporte.
  • Bases de Conhecimento: Importe os documentos compatíveis, monte índices locais, recupere trechos embasados e abra as citações na fonte.
  • Perfis e LoRA: Salve combinações de modelo, contexto, amostragem, back-end e adaptadores para um trabalho repetível.
  • Modelos de prompt e Ações: Reutilize prompts privados e execute fluxos com texto compartilhado que mantêm os resultados disponíveis para copiar, compartilhar ou continuar a conversa.
  • Controle portátil: Exporte conversas, execute uma API local no desktop quando ativada explicitamente e crie arquivos de backup e restauração criptografados.
Observação: Os modelos baixados e os documentos de origem podem ter licenças e restrições de uso próprias. Consulte-as antes de usar ou redistribuir.

Configurações

Abra as Configurações para consultar os seguintes controles específicos do aplicativo:

  • Preferências de mecanismo nativo, back-end, threads, contexto, cache, armazenamento e modelos
  • Comportamento de extração de conhecimento, embeddings, recuperação, embasamento e citações
  • API local no desktop, rede, compartilhamento no celular, modelos de prompt e ações
  • Privacidade, backup criptografado, exclusão, aparência, atalhos, diagnósticos e licenças

Teste, Free e Pro usam o mesmo conjunto funcional de recursos. O Pro remove os anúncios no celular e o lembrete diário de apoio no desktop.

Atalhos de teclado

Nas plataformas da Apple, use Command quando o aplicativo mapear um atalho exibido como Ctrl para o modificador principal da plataforma. A página de atalhos dentro do aplicativo continua sendo a referência definitiva.

AtalhoAção
Cmd/Ctrl + NNova conversa
Cmd/Ctrl + KBuscar conversas
Cmd/Ctrl + MEscolher modelo
Cmd/Ctrl + BEscolher Base de Conhecimento
Cmd/Ctrl + Alt/Option + IDetalhes da conversa
EscParar a geração

Dicas & Truques

Escolha um contexto ou um modelo menor antes de forçar uma configuração que não cabe na memória.
Use o embasamento estrito quando a resposta tiver de ficar restrita às fontes indexadas.
Abra as citações e compare o trecho extraído antes de confiar em uma afirmação gerada.
Guarde as senhas de backup separadas do arquivo de backup criptografado.

Solução de problemas

ProblemaO que verificar
Um modelo não carregaVerifique a compatibilidade, a estimativa de memória, o armazenamento, a verificação do arquivo, o back-end selecionado e se há outra sessão de modelo ativa.
A geração está lentaUse o diagnóstico do dispositivo, um modelo ou contexto menor, um back-end adequado e um desempenho medido, e não presumido.
O Conhecimento não tem a respostaVerifique a extração do documento, o status do índice, o teste de recuperação, os filtros e se a fonte realmente contém a evidência.
Um backup não é restauradoConfira a senha, a integridade do arquivo, a compatibilidade do esquema, o espaço livre e a revisão da restauração antes de substituir os dados atuais.

Privacidade

  • Prompts, conversas, documentos, embeddings, recuperação e texto gerado permanecem no dispositivo.
  • O uso da rede se limita ao catálogo/busca solicitados, ao download de modelos, à verificação de atualizações ou a um endpoint de API que você ative explicitamente.
  • As entradas compartilhadas no celular são temporárias e os originais externos nunca são excluídos.
  • Os dados do espaço de trabalho pertencentes ao app e as cópias gerenciadas podem ser removidos pelo fluxo de privacidade revisado.
Sua responsabilidade: Não exponha a API opcional do desktop além de um limite confiável nem use modelos e documentos de forma contrária às licenças deles.