---
🦙 Ollama: rode LLMs localmente em 5 minutos
📌 Pra que serve
Ollama é um executor de modelos de linguagem que roda direto na sua máquina (macOS, Windows, Linux). Sem dependências complexas, sem APIs pagas — você conversa com IA offline, com privacidade total. Ideal pra quem quer testar, brincar ou integrar LLMs em projetos sem custo.🛠️ Passo a passo
1. Instale o Ollama
Acesse https://ollama.com/download e baixe a versão pro seu SO. Siga o instalador (é rápido).
2. Abra o menu interativo
No terminal, digite:
ollamaVocê verá um menu com opções: rodar modelo, acessar ferramentas (Claude Code, VS Code integration, etc).
3. Inicie seu primeiro chat
Escolha um modelo leve (Gemma é ótimo pra começar):
ollama run gemma2Aguarde o download (primeira vez demora um pouco, depois fica em cache local).
4. Converse
Quando o prompt >>> aparecer, mande sua pergunta:
>>> Explique por que o céu é azul em um parágrafo.O modelo responde na hora, localmente.
5. Saia
Digite /bye pra encerrar.
💡 Dica:
Modelos menores (Gemma, Mistral 7B) rodam até em notebook. Quer integrar com código? Ollama também oferece API local emlocalhost:11434 — perfeito pra Python, Node, Java. Teste ollama run llama2 se quiser algo mais robusto.🔗 Links e instalação
- Site oficial: https://ollama.com
- Download: https://ollama.com/download
- Documentação completa: https://docs.ollama.com/quickstart
- Repositório GitHub: https://github.com/ollama/ollama
- Modelos disponíveis: https://ollama.com/library
Totalmente gratuito e open-source. Sem conta, sem limite de uso.