Analise documentos de centenas de páginas localmente com Qwen3 e LM Studio sem enviar dados para a nuvem
Execute um modelo com janela de contexto de 128K no seu computador e obtenha resumo, pontos-chave e respostas sobre qualquer PDF ou DOCX grande
- 1.Baixe e instale o LM Studio - programa para rodar modelos de IA localmente. Acesse o site, escolha a versão para seu sistema (Windows / Mac / Linux) e instale.
O programa é gratuito e funciona offline após a instalação. Se o site não abrir na sua região, tente usar VPN para baixar; a execução do modelo não exige internet.
LM Studio ↗Sobre a ferramenta - 2.Abra o LM Studio, digite «Qwen3 32B GGUF» na barra de busca e baixe a versão quantizada (procure o arquivo com Q4_K_M no nome - equilibra bem qualidade e consumo de memória). Clique em Download.
O modelo Qwen3 32B suporta janela de contexto de até 128.000 tokens - cerca de 300 a 400 páginas de texto. Para rodá-lo, recomenda-se 16+ GB de RAM. Se você tem menos memória, procure Qwen3 14B ou Qwen3 8B, que também suportam contexto grande.
LM Studio ↗Sobre a ferramenta - 3.Após o download do modelo, vá para a aba de chat (ícone de diálogo no menu à esquerda). Na lista suspensa, selecione o modelo Qwen3 baixado. No painel de configurações à direita, encontre o parâmetro «Context Length» e defina como 131072 (ou o máximo que sua placa de vídeo/RAM permitir).
Quanto maior a janela de contexto, mais RAM é usada. Se o modelo não iniciar, reduza Context Length para 65536 ou 32768. Para a maioria dos documentos, 32K basta.
LM Studio ↗Sobre a ferramenta - 4.Clique no botão de clipe (ou «Attach File») na barra de entrada do chat e selecione seu documento - PDF, DOCX ou TXT. O LM Studio extrairá o texto e o carregará no contexto do modelo. Aguarde até que o arquivo apareça no chat como anexo.
⚠️ Atenção: o documento é processado localmente e não é enviado para servidores externos. É seguro para materiais confidenciais. PDFs com texto são suportados; scanned sem camada de texto precisam passar por OCR antes (por exemplo, com o OCR MyPDF gratuito).
LM Studio ↗Sobre a ferramenta - 5.Cole o prompt abaixo no chat, substituindo o texto entre colchetes pela sua tarefa. Clique em Send e aguarde a resposta do modelo.
O modelo pode gerar a resposta de 30 segundos a vários minutos, dependendo do tamanho do documento e da potência do seu hardware. O progresso é visível pela saída de texto em streaming.
LM Studio ↗Sobre a ferramentaPromptVocê é um analista especialista. Leia o documento anexo com atenção e faça o seguinte: 1. Escreva um resumo conciso em 5-7 frases. 2. Liste os 10 pontos-chave mais importantes em tópicos. 3. Extraia todas as datas, números e nomes próprios mencionados no documento. 4. Responda a esta pergunta com base APENAS no documento: [SUA_PERGUNTA_SOBRE_O_DOCUMENTO] Se a resposta à pergunta não for encontrada no documento, diga: «Esta informação não está presente no documento.»
O que este prompt fazO prompt pede ao modelo: 1) escrever um resumo em 5-7 frases, 2) destacar 10 pontos-chave, 3) extrair todas as datas, números e nomes próprios, 4) responder à sua pergunta estritamente com base no texto do documento. Substitua [SUA_PERGUNTA_SOBRE_O_DOCUMENTO] por uma pergunta específica, como «Quais riscos estão indicados no contrato?» ou «Qual é o orçamento total do projeto?». - 6.Se necessário, faça perguntas de acompanhamento - o modelo «lembra» de todo o documento no contexto, e você pode conversar sem precisar reenviar o arquivo.
O histórico do chat é salvo no LM Studio. Para começar uma nova análise de outro documento, clique em «New Chat» no painel superior; caso contrário, o contexto se acumulará e a velocidade diminuirá.
LM Studio ↗Sobre a ferramentaPromptAgora compare a seção [A] com a seção [B] do documento. Destaque quaisquer contradições, sobreposições ou lacunas entre elas. Apresente a comparação em formato de tabela.
O que este prompt fazEste prompt pede ao modelo para comparar duas seções do documento, encontrar contradições, sobreposições e lacunas, e apresentar o resultado em uma tabela. Substitua [A] e [B] pelos nomes ou números das seções, como «Seção 3» e «Anexo 2».
- grátisLM StudioO programa é totalmente gratuito, sem limites de número de requisições ou documentos.
- grátisQwen3 32B GGUF (modelo)O modelo é gratuito e baixado direto do LM Studio. Para rodar a versão 32B, recomenda-se 16+ GB de RAM; versões mais leves (8B, 14B) funcionam com 8 GB.
Por que hoje
Serviços de IA mudam rápido - interfaces e limites gratuitos podem diferir do descrito.