Automação clássica segue regras fixas: "se A, faça B". Mas e quando a decisão exige entender um texto — classificar a intenção de um e-mail, resumir um relatório, extrair dados de uma mensagem bagunçada? Aí você une duas ferramentas self-hosted: o n8n para orquestrar e um LLM local para pensar. O resultado são automações que leem, entendem e decidem — no seu servidor.
A combinação: n8n + LLM local
- O n8n é a espinha dorsal: gatilhos, conexões com APIs, lógica e ações.
- O Ollama roda o modelo de linguagem localmente e expõe uma API.
- No n8n, um nó chama a API do Ollama, passa o texto, recebe a resposta do modelo e segue o fluxo com base nela.
Como o Ollama expõe uma API HTTP simples, plugar os dois é direto — e tudo roda na mesma VPS, sem enviar dados para fora.
Ideias práticas de fluxos
Triagem de e-mails/tickets
Chegou um e-mail → o LLM classifica (dúvida, reclamação, financeiro, spam) e resume em uma linha → o n8n encaminha para a fila/pessoa certa. Fim do trabalho manual de separar.
Resumo automático
Todo dia às 8h → o n8n coleta os textos (relatórios, notícias, mensagens) → o LLM resume → envia o resumo pronto no seu Telegram/e-mail.
Extração de dados
Recebeu uma mensagem ou documento não estruturado → o LLM extrai os campos (nome, valor, data, pedido) em formato limpo → o n8n grava no banco/planilha/CRM.
Respostas assistidas
Nova pergunta na base → RAG busca nos seus documentos → o LLM redige um rascunho de resposta → o n8n envia para um humano aprovar antes de responder.
Moderação e classificação de conteúdo
Novo comentário/envio → o LLM avalia tom e categoria → o n8n aprova, sinaliza ou arquiva.
Enriquecimento
Novo lead → o n8n junta dados de várias fontes → o LLM sintetiza um resumo do lead para o vendedor.
Por que fazer isso self-hosted
- Privacidade — os textos processados (e-mails, documentos, dados de clientes) não saem do servidor. Para automação com dado sensível, isso é essencial.
- Custo fixo — automação com IA por API cobra por token e por execução; em alto volume, explode. Local, você paga só a VPS.
- Sem limites — rode quantos fluxos e chamadas quiser.
- Controle — você escolhe o modelo, ajusta os prompts e versiona tudo.
Boas práticas
- Escolha um modelo compatível com a tarefa — classificação e extração funcionam bem até com modelos pequenos em CPU. Veja qual modelo cabe na sua VPS.
- Prompts claros e com exemplos — a qualidade da automação depende do prompt.
- Peça saída estruturada (ex.: JSON) para o n8n processar o resultado com segurança.
- Coloque um humano no circuito para ações sensíveis (responder cliente, mexer em dinheiro) — o LLM sugere, a pessoa aprova.
- Dimensione a RAM — o gargalo é o modelo; deixe folga se o fluxo dispara várias chamadas.
Automação que entende, no seu servidor
n8n + LLM local transforma automação de "regras cegas" em fluxos que compreendem texto — com privacidade e custo fixo. Tudo numa VPS com RAM:
Monte a base: n8n para orquestrar e Ollama para a inteligência.

