Rode o modelo de linguagem da Meta no seu computador - sem internet, assinaturas e nuvem
Instale o Ollama, baixe o modelo open-source Llama e comece a conversar em 5 minutos de trabalho ativo
- 1.Baixe o Ollama do site oficial e instale como um programa comum. No macOS - arraste o ícone para Applications, no Windows - execute o instalador e clique em Next. Após a instalação, o app roda em segundo plano.
Ollama - programa gratuito de código aberto. Ele baixa e roda modelos de linguagem direto no seu computador, sem enviar dados para a internet. Para um modelo de 8 bilhões de parâmetros são necessários no mínimo 8 GB de RAM, para uso confortável - 16 GB.
Ollama ↗Sobre a ferramenta - 2.Abra o Terminal: no macOS pressione Cmd+Space e digite «Terminal», no Windows pressione Win+R, digite «cmd» e pressione Enter. Você também pode usar o PowerShell.
O Terminal é um programa de texto para controlar o computador. Não se assuste com a tela preta: você vai precisar de apenas um comando. Se o Ollama estiver instalado corretamente, o comando ollama --version vai mostrar o número da versão.
- 3.Digite o comando abaixo e pressione Enter. No primeiro uso, o Ollama vai baixar o modelo (cerca de 4,7 GB) e depois abrir o chat automaticamente. O download demora alguns minutos dependendo da velocidade da internet.
Se você tem pouca RAM, substitua llama3.1:8b por llama3.2:3b (precisa de ~4 GB) ou llama3.2:1b (precisa de ~2 GB). Para ver todas as versões disponíveis dos modelos da Meta, execute: ollama search llama
Ollama ↗Sobre a ferramentaPromptollama run llama3.1:8b
O que este prompt fazEste comando baixa o modelo Llama 3.1 da Meta (8 bilhões de parâmetros) e abre o chat no terminal. Após o download, aparecerá a linha >>> - já dá para escrever mensagens para o modelo. - 4.Quando aparecer a linha >>>, o modelo está pronto. Escreva um pedido em português ou inglês e pressione Enter - a resposta aparece direto no terminal. Experimente este prompt para testar:
Para sair do chat, digite /bye ou pressione Ctrl+D. O modelo fica salvo no disco - na próxima vez ele inicia instantaneamente. Para baixar sem abrir o chat, use ollama pull em vez de ollama run.
Sobre a ferramentaPromptVocê é um assistente. Explique o que é recursão de forma simples, com um exemplo em Python. A resposta deve ter no máximo 10 linhas.
O que este prompt fazO prompt define o papel e a tarefa específica do modelo - explicar recursão com um exemplo de código. Troque o tema por qualquer outro que você precisar: ajuda com texto, código, tradução, ideias. O modelo Llama 3.1 entende bem o português. - 5.Para uma interface no estilo ChatGPT, instale o Chatbox - um app de desktop que se conecta ao Ollama. Baixe o instalador, abra o programa, nas configurações escolha Ollama como provedor e o modelo llama3.1:8b.
O Chatbox oferece uma interface familiar com histórico de conversas, formatação de texto e salvamento de diálogos. O app é gratuito e funciona localmente. Alternativas: LM Studio (lmstudio.ai) ou Open WebUI (precisa de Docker).
Chatbox ↗
- grátisOllamaPrograma totalmente gratuito de código aberto, sem limites de número de requisições ou modelos.
- grátisModelo Llama 3.1 (Meta)O modelo é baixado de graça. Para a versão 8B são necessários no mínimo 8 GB de RAM, para a 3B - cerca de 4 GB, para a 1B - cerca de 2 GB.
- grátisChatboxApp de desktop gratuito de código aberto, sem limites. Funciona localmente, os dados não vão para servidores.
Serviços de IA mudam rápido - interfaces e limites gratuitos podem diferir do descrito.