O Ollama coloca um LLM rodando no seu servidor, mas conversar por linha de comando cansa rápido. O Open WebUI resolve isso: é uma interface web bonita, muito parecida com o ChatGPT, que se conecta aos seus modelos locais. Do terminal cru para um chat profissional no navegador.
O que é o Open WebUI
Open WebUI é uma interface web open source para modelos de linguagem. Ele conversa com o Ollama (e com APIs compatíveis) e entrega a experiência que você já conhece:
- Chat no navegador — igual ao que você usa nos serviços de IA comerciais.
- Histórico de conversas — tudo salvo e organizado.
- Troca de modelos — alterne entre os modelos instalados num clique.
- Multiusuário — crie contas para a família ou a equipe, com controle de acesso.
- RAG embutido — envie documentos e converse com base neles (veja RAG self-hosted).
- Prompts salvos e outros recursos de produtividade.
Tudo isso rodando no seu servidor, com os dados sob seu controle.
Como rodar na VPS
O Open WebUI roda como um contêiner Docker e se conecta ao Ollama. O fluxo geral:
- Tenha o Ollama rodando na VPS com pelo menos um modelo baixado.
- Suba o contêiner do Open WebUI (via Docker Compose é o mais limpo — veja o guia de Docker).
- Aponte o Open WebUI para o endereço da API do Ollama.
- Acesse pelo navegador, crie o usuário admin e comece a conversar.
- (Recomendado) Coloque um proxy reverso com HTTPS na frente para acessar por um domínio seguro.
Em poucos minutos você tem o seu "ChatGPT privado" no ar.
Por que isso muda o jogo
A interface transforma a IA local de "experimento de terminal" em ferramenta do dia a dia:
- Você (e sua equipe) usam sem saber comando nenhum.
- O histórico deixa o trabalho contínuo, não descartável.
- O RAG permite perguntar sobre seus documentos — manuais, contratos, base de conhecimento — sem que eles saiam do servidor.
- Multiusuário faz uma VPS servir uma família ou empresa inteira com IA privada.
Boas práticas
- Proteja o acesso — é uma aplicação web com seus dados e conversas; use HTTPS e senhas fortes. Feche o auto-registro depois de criar as contas.
- Dimensione pela RAM do modelo — o Open WebUI em si é leve; quem pesa é o modelo no Ollama por trás.
- Backup — as conversas e configurações ficam num volume; inclua no seu backup.
- Um domínio bonito via proxy reverso deixa o acesso profissional.
Seu ChatGPT privado, no seu servidor
Ollama + Open WebUI é a dupla que entrega uma experiência de IA completa e privada. Só precisa de uma VPS com RAM para o modelo:
Falta escolher o hardware certo? Entenda CPU vs GPU para IA.

