---
🤖 Configurar ambiente de IA local com Ollama
📌 Pra que serve
Executar modelos de linguagem grandes na sua máquina sem depender de APIs pagas (OpenAI, Anthropic). Ideal para prototipagem offline, análise de dados privados, conclusão de código — tudo roda localmente, sem internet, sem custo por request.
🛠️ Passo a passo
1. Instale o Ollama
macOS/Linux:
curl -fsSL https://ollama.com/install.sh | shWindows: baixe direto de https://ollama.com/download
Verifique:
ollama --version2. Puxe um modelo (escolha conforme seu hardware)
Para 8GB RAM (laptop comum):
ollama pull llama3.1:8bPara código específico:
ollama pull qwen2.5-coder:7b3. Rode seu primeiro modelo
ollama run llama3.1:8bPronto — você entra num chat. Digite e converse. O servidor roda em localhost:11434 automaticamente.
4. Integre ao seu editor (Continue.dev + VS Code)
Crie ou edite ~/.continue/config.json:
{
"models": [
{
"title": "Local Qwen Coder",
"provider": "ollama",
"model": "qwen2.5-coder:7b",
"apiBase": "http://localhost:11434"
}
]
}Instale a extensão Continue no VS Code, aponte pro Ollama e comece a usar code completion local.
5. Use via Python (scripting)
import ollamaresponse = ollama.chat(
model='llama3.1:8b',
messages=[
{'role': 'user', 'content': 'Resuma este changelog em 3 pontos'}
]
)
print(response['message']['content'])
6. Customize um modelo (ex: revisor de código)
Crie Modelfile:
FROM qwen2.5-coder:7b
PARAMETER temperature 0.2
SYSTEM """
Você é um revisor sênior terse. Aponte bugs e questões de segurança.
Uma linha por achado.
"""Registre:
ollama create code-reviewer -f ./Modelfile
ollama run code-reviewer💡 Dica:
Modelos 7-8B rodam em CPU, mas GPU acelera drasticamente. Se tiver NVIDIA + CUDA, confirme com ollama ps que o modelo está rodando em GPU
(não CPU fallback). Em Apple Silicon, um M1/M2 com 16GB unified memory já roda 13B modelos bem.
🔗 Links e instalação
- Site oficial: https://ollama.com
- GitHub: https://github.com/ollama/ollama
- Modelos disponíveis: https://ollama.com/library
- Integração Continue.dev: https://continue.dev
- Referência original: https://techpulsesite.com/how-to-set-up-a-local-ai-dev-environment-with-ollama-2026/