🦙 Meta Muse Glimmer — agentes de IA rodando local numa única GPU
Nível 4 · 👁️ Polifemo · ⏱️ ~45 min · Pré-requisitos: GPU 20GB+, Python, familiaridade com transformers/llama.cpp
📌 Pra que serve
Muse Glimmer é um modelo aberto de 30 bilhões de parâmetros (licença Apache 2.0) que a Meta otimizou para executar agentes, não só bater papo: coding, function calling, agendamento, organização de arquivos e tarefas multi-etapa com recuperação de falhas. O ponto forte é o footprint reduzido — cabe em menos de ~20 GB de VRAM, ou seja, roda num Mac de ponta ou PC gamer comum, sem depender de API paga ou nuvem.
🛠️ Passo a passo
1. Confirme sua GPU: você precisa de pelo menos ~20 GB de VRAM (ex.: RTX 4090, 3090, ou Mac com chip M-series e memória unificada suficiente).
2. Instale o llama.cpp ou use transformers da Hugging Face como runtime:
pip install transformers accelerate torch
3. Procure o repositório oficial "Muse Glimmer" no Hugging Face (busque por "Meta Muse Glimmer 30B") e baixe os pesos (ou a versão quantizada GGUF, se disponível).
4. Carregue o modelo localmente:
```python
from transformers import AutoModelForC