AE Agent
Usar modelos locais (Ollama / LM Studio)
Execute um modelo de IA inteiramente na sua própria máquina — grátis, privado e offline. O AE Agent se conecta ao Ollama, ao LM Studio ou a qualquer endpoint compatível com OpenAI rodando localmente. Nada sai do seu computador.
Os modelos locais são ótimos para privacidade e custo zero, mas a qualidade no uso de ferramentas varia de modelo para modelo. Para o modo Agente, use um modelo recente e capaz —
llama3.1 ou mais novo, ou qwen2.5 ou mais novo. Modelos menores ou mais antigos podem ter dificuldade para chamar ferramentas de forma confiável.Ollama
1
Instale o Ollama
Baixe e instale o Ollama para o seu sistema operacional em ollama.com/download. Ele roda um servidor local em
http://localhost:11434.2
Baixe e execute um modelo
Em um terminal, baixe um modelo com suporte a ferramentas e inicie-o:A primeira execução baixa o modelo. Depois disso, ele fica disponível localmente.
ollama run llama3.1
3
Conecte no AE Agent
Abra Settings → Local AI e defina a URL como:Clique em Detect models. O AE Agent lista todos os modelos que você baixou. Escolha um — ele aparece no seletor de modelos em Local.
http://localhost:11434
LM Studio
1
Instale e carregue um modelo
Instale o LM Studio a partir de lmstudio.ai, baixe um modelo da biblioteca dele e carregue-o.
2
Inicie o servidor local
No LM Studio, abra a aba Local Server e inicie o servidor. Ele expõe um endpoint compatível com OpenAI em
http://localhost:1234.3
Conecte no AE Agent
Em Settings → Local AI, defina a URL como:Clique em Detect models e selecione o modelo que você carregou.
http://localhost:1234
Endpoints personalizados compatíveis com OpenAI
Qualquer servidor compatível com a API de chat completions da OpenAI funciona do mesmo jeito. Digite a URL base dele em Settings → Local AI e clique em Detect models. Isso inclui runtimes auto-hospedados, como o servidor do llama.cpp, o vLLM e similares.
Endpoints padrão
| Ollama | http://localhost:11434 |
| LM Studio | http://localhost:1234 |
| Personalizado | Sua URL base compatível com OpenAI |
Se Detect models não encontrar nada, confirme que o servidor local está realmente rodando e que a URL/porta coincide. Além disso, o modelo precisa ter sido baixado (Ollama) ou carregado (LM Studio) para aparecer.