Trilha 03 · Para o trabalho

O profissional com documentos confidenciais — « Meus arquivos não saem do meu computador. »

Profissional do direito, médico, profissional de RH, consultor, contador, notário — seus documentos estão protegidos por sigilo profissional ou NDA. Um LLM local combinado com RAG permite que você faça perguntas sobre eles, resuma, compare e cruze informações, sem nunca fazer upload de nada. E sem linha de comando.

Duração total
~45 min
Nível exigido
Nenhum pré-requisito técnico
Custo
0 €
Máquina típica
PC ou Mac com 16 GB de RAM (32 GB recomendados)
↑
Nossa promessa

No final, LM Studio rodará com uma interface gráfica sofisticada (sem terminal). Um modelo de 13 a 24B será carregado. Uma pasta de PDFs será indexada via AnythingLLM ou a funcionalidade de Documentos integrada. Você poderá fazer perguntas em francês aos seus arquivos, obter citações exatas com número de página e exportar um resumo — sem que nenhum byte saia do seu computador.

Para quem este percurso foi pensado

Preferimos avisar você logo a deixar você perder 30 minutos à toa.

✓ É para você se
  • ✓Seus documentos estão protegidos pelo sigilo profissional (advogado, médico, notário, contador).
  • ✓Você trabalha sob NDA e as ferramentas de nuvem são proibidas por contrato.
  • ✓Você gerencia dados pessoais sujeitos ao RGPD — evitar transferências para fora da UE é um dever.
  • ✓Você quer uma interface limpa e clara, não um comando no terminal.
  • ✓Você tem de 100 a 10.000 PDFs para consultar sem precisar enviá-los novamente a cada vez.
✕ Procure outras opções se
  • ·Seus dados são públicos e você quer apenas um assistente: um serviço na nuvem será mais simples.
  • ·Você gerencia terabytes de documentos: precisa de uma implantação em servidor, não de uma estação de trabalho.
  • ·Você quer tempo real em centenas de documentos por segundo: um RAG simples não vai dar conta, veja vLLM ou TGI.

O percurso em 5 etapas

Cada etapa leva a um guia detalhado que você pode ler em paralelo. A ordem foi otimizada: não pule nenhuma etapa na primeira vez.

Acumulado · ~45 min
  1. 1
    Etapa 01·5 min·Iniciante

    Instale LM Studio

    Instalador clássico para Windows, macOS ou Linux. Interface gráfica completa: pesquisa, download de modelos, chat, configurações — sem nunca abrir um terminal.

    LM Studio está instalado, você vê a galeria de modelos.
    Leia o guia →
  2. 2
    Etapa 02·8 min·Intermediário

    Escolher um modelo de 13 a 24B

    Mistral Small 24B em Q4 se você tiver 16 GB de VRAM. Qwen2.5 14B em Q4 se você tiver 12 GB. Download direto no app, verificação de integridade automática.

    Um modelo robusto para análise de texto está carregado na memória.
    Leia o guia →
  3. 3
    Etapa 03·20 min·Iniciante

    Indexar seus documentos

    AnythingLLM ou Open WebUI para a parte RAG. Apontar para uma pasta, escolher um modelo de embeddings francês (Solon, BGE-M3), iniciar a indexação. Tudo permanece no disco.

    Seus PDFs estão indexados em uma base vetorial local (ChromaDB).
    Leia o guia →
  4. 4
    Etapa 04·8 min·Iniciante

    Verificar isolamento de rede

    Uma checklist: Wireshark para confirmar que nada sai, desativação de telemetrias eventuais, criptografia do diretório dos modelos, backup local criptografado.

    Confiança verificada: zero pacotes enviados durante o uso.
    Leia o guia →
  5. +
    Etapa bonus·15 min·Avançado

    Bônus — Isolamento completo de rede (air-gap)

    Para os dossiês mais sensíveis: uma regra de firewall que bloqueie todas as conexões de saída, exceto as atualizações automáticas do sistema. É uma precaução em dose dupla.

    Máquina certificada off-line para sessões sensíveis.
    Leia o guia →

Modelos recomendados

Três opções testadas para este percurso — da mais leve à mais capaz. Clique para ver a ficha detalhada (VRAM, contexto e benchmarks).

O início
Mistral Small 3
Mistral AI · 24B · 14 GB em Q4

Uma boa escolha padrão para uso profissional. Excelente em francês, na síntese de textos longos e no raciocínio jurídico.

Veja o detalhamento →
Modelo referenciado
qwen2.5-14b

Mais leve (9 GB em Q4), muito bom em análise estruturada. Para máquinas mais modestas.

Modelo referenciado
llama-3.3-70b

Para Macs com 64 GB ou estações com 48 GB de VRAM. Qualidade equivalente à do "GPT-4 de 2023" em execução local.

Perguntas frequentes

As perguntas reais que recebemos por e-mail e no Mastodon. Se a sua não estiver aqui, abra um ticket.

Sim, pela própria concepção: nenhum dado é transmitido a um operador de dados. Você continua sendo o único controlador dos dados. Basta cuidar da criptografia de disco (BitLocker, FileVault, LUKS) e da política de exclusão das conversas.
Após concluir este percurso
Próximo percurso

O curioso — « Quero só experimentar, sem complicações. »

Você ouviu falar dos LLMs locais e quer ver como eles funcionam na sua máquina. Nenhum código, nenhuma linha de comando complicada — em 15 minutos você conversa com seu…

→
O kit RAG Local

Seus documentos, sua IA: um RAG local confiável para seus PDFs, notas e e-mails — sem enviar nada para a nuvem.

  • Espaço online vitalício
  • PDF + arquivos
  • Atualizações vitalícias

Uma pergunta, um erro de digitação, um bug?

Este caminho evolui a cada lançamento de modelo. Seus feedbacks são a matéria-prima.