🦙 Instalar Ollama e rodar seu primeiro modelo local
Nível 4 · 👁️ Polifemo · ⏱️ ~20 min · Pré-requisitos: terminal básico, espaço em disco (~10GB) e RAM adequada📌 Pra que serve
Ollama permite executar modelos de linguagem grandes (LLMs) diretamente no seu computador, sem depender de APIs pagas. Ideal para prototipagem, privacidade de dados e desenvolvimento offline. Você controla tudo localmente.
🛠️ Passo a passo
1. Baixar e instalar Ollama
- Acesse [ollama.ai](https://ollama.ai)
- Escolha seu SO (Windows, macOS ou Linux)
- Execute o instalador e siga as instruções padrão
2. Verificar instalação
ollama --version3. Baixar um modelo (comece com Mistral, leve e rápido)
ollama pull mistralOutros modelos populares:
llama2, neural-chat, orca-mini4. Rodar o modelo em modo interativo
ollama run mistralAgora você tem um chat local funcionando. Digite suas perguntas e pressione Enter.
5. (Opcional) Acessar via API local
Abra outro terminal e faça requisições:
curl http://localhost:11434/api/generate -d '{
"model": "mistral",
"prompt": "Qual é a capital do Brasil?",
"stream": false
}'6. Parar o modelo
No terminal interativo, digite /exit ou pressione Ctrl+D.
💡 Dica:
Comece com modelos menores (Mistral, Orca-mini) se sua máquina tiver pouca RAM. Useollama list para ver todos os modelos instalados e ollama rm <modelo> para liberar espaço. Para integrar com ferramentas Python, use a biblioteca ollama (pip install ollama).🔗 Links e instalação
- Site oficial: https://ollama.ai
- GitHub: https://github.com/ollama/ollama
- Documentação: https://github.com/ollama/ollama/blob/main/README.md
- Modelos disponíveis: https://ollama.ai/library
Requisitos mínimos: 4GB RAM (8GB recomendado), ~10GB disco para modelo base.