Ollama — Modelos Locais
O add-on Ollama permite rodar modelos de IA diretamente na VM do seu agente, sem enviar dados para APIs externas.
O que é o Ollama?
Ollama é um runtime open-source para modelos de linguagem locais. Com ele, seu agente pode usar modelos como Llama, Mistral, CodeLlama e outros sem depender de APIs pagas.
Vantagens
- Privacidade — dados não saem da sua VM
- Sem custos de API — modelo roda localmente
- Baixa latência — sem round-trip para servidores externos
- Offline — funciona mesmo sem internet (após download do modelo)
Requisitos
Modelos locais exigem RAM significativa. Recomendações:
| Modelo | RAM mínima | VM recomendada |
|---|---|---|
| Modelos pequenos (3B) | 4 GB | Contabo VPS S |
| Modelos médios (7B) | 8 GB | Contabo VPS M |
| Modelos grandes (13B+) | 16 GB+ | Contabo VPS L |
Como ativar
- Na criação do agente (Modo Avançado → Add-ons) ou na página de configurações
- Ative o toggle Ollama
- O Ollama será instalado na VM durante o provisionamento
- Selecione o modelo desejado