Ilustração do Open WebUI conectando modelos de IA locais e APIs em um servidor VPS

VPS para Open WebUI: onde hospedar e quanto custa de verdade

Melhor custo hoje · uso leve
R$ 29,99/mês · Hostinger KVM 1

1 vCPU · 4 GB RAM · 50 GB NVMe — renova R$ 59,99.

Ver oferta e cupom →

preços conferidos em 22/07/2026renovação inclusa5 provedores comparados
Open WebUI é uma interface de IA self-hosted para conversar com Ollama, APIs compatíveis com OpenAI e outros provedores. Em uma VPS, ela vira uma porta própria para chat, RAG e equipes. Aqui você compara o porte do servidor, entende quando GPU entra na conta e separa a interface do custo de inferência.

Qual porte de Open WebUI você vai rodar?

Requisitos conferidos em 29/07/2026: Open WebUI Docs: fundamentos de implantação, embeddings locais e consumo aproximado de 500 MB de RAM por worker · README oficial do Open WebUI: Docker, APIs compatíveis com OpenAI, imagens com Ollama e uso opcional de GPU · Hostinger: página oficial do template Open WebUI, com os perfis KVM 1 (1 vCPU, 4 GB RAM, 50 GB), KVM 2 (2 vCPUs, 8 GB RAM, 100 GB) e KVM 4 (4 vCPUs, 16 GB RAM, 200 GB) · Open WebUI Docs: escalabilidade, embeddings locais e isolamento de processos de extração de conteúdo.

KVM 1
⚙️ 1 vCPU🧠 4 GB RAM💾 50 GB NVMe🇧🇷 Brasil🎟️ cupom disponível
R$ 29,99/mês
renova R$ 59,99

Ver oferta

Rapid VPS I
⚙️ 2 vCPU🧠 4 GB RAM💾 100 GB NVMe🇧🇷 Brasil🎟️ cupom disponível
R$ 97,00/mês
sem pulo de renovação

Ver oferta

Basic 2vCPU/4GB
⚙️ 2 vCPU🧠 4 GB RAM💾 80 GB NVMe🌎 exterior
R$ 132,00/mês
US$ 24 × 5.50

Ver oferta

VPS Professional
⚙️ 3 vCPU🧠 8 GB RAM💾 60 GB NVMe🇧🇷 Brasil
R$ 161,60/mês
sem pulo de renovação

Ver oferta

VPS App
⚙️ 2 vCPU🧠 8 GB RAM💾 50 GB NVMe🇧🇷 Brasil🎟️ cupom disponível
R$ 169,90/mês
sem pulo de renovação

Ver oferta

Preço promocional e de renovação conferidos manualmente em 22/07/2026. Internacionais em dólar (câmbio 5.50, sem IOF).

O Open WebUI não publica um mínimo universal de vCPU, RAM e disco para todos os usos. Os números da tabela são os perfis que a página oficial da Hostinger exibe para implantar o app, não uma garantia do projeto. O consumo muda principalmente com RAG, documentos, quantidade de workers e se o modelo roda na mesma máquina. A documentação informa que o embedding local padrão usa cerca de 500 MB de RAM por worker; por isso, uma instalação com vários workers ou ingestão intensa não deve ser dimensionada como um simples chat. GPU não é necessária quando o Open WebUI só chama GPT, Claude, Gemini, OpenRouter ou outro endpoint remoto. Ela é opcional para a interface e passa a importar se você rodar Ollama ou outro modelo local no mesmo servidor. Nesse caso, dimensione também a RAM ou VRAM do modelo, do contexto e da concorrência.

Open WebUI: principais recursos

Chat com modelos diferentes
Reúne modelos do Ollama e APIs compatíveis com OpenAI em uma única interface web.
Uso local ou por API
Pode apontar para um modelo local, um provedor remoto ou uma combinação dos dois.
RAG para documentos
Inclui motor de inferência para recuperação de conteúdo e chat baseado em arquivos.
Imagem Docker oficial
A implantação oficial usa um volume persistente para guardar os dados da aplicação.
Embeddings configuráveis
O embedding local pode ser trocado por uma API externa quando RAM e escala exigem outra arquitetura.
GPU quando fizer sentido
Há imagem CUDA para o cenário com NVIDIA, mas a instalação também funciona sem GPU.

Open WebUI faz mais sentido como camada de acesso do que como servidor de modelo por si só. Ele permite que uma equipe use a mesma interface para um Ollama privado, um endpoint compatível com OpenAI ou APIs de terceiros. Isso ajuda a centralizar conversas e documentos, mas não elimina a conta do provedor quando a resposta vem de uma API. Se você ligar o Open WebUI a um modelo local, aí a infraestrutura de inferência também passa a ser sua responsabilidade.

O dimensionamento muda bastante quando o chat deixa de ser apenas texto. O embedding padrão local consome memória por worker, e a ingestão de documentos adiciona extração, armazenamento e picos de uso. Para teste individual com APIs externas, um perfil inicial pode bastar. Para RAG compartilhado, monitore RAM, disco e crescimento do banco antes de aumentar usuários. Evite comprar GPU por reflexo: ela serve para modelos locais ou aceleração específica, não para uma interface conectada apenas a APIs remotas.

Instalando o Open WebUI na VPS (resumo)

  1. Escolha o porte pela tabela como referência de implantação e separe a necessidade da interface da necessidade de inferência do modelo.
  2. Na Hostinger, selecione o template Open WebUI; em instalação manual, use a imagem oficial ghcr.io/open-webui/open-webui e mantenha o volume /app/backend/data persistente.
  3. Conecte primeiro uma única fonte de modelos: uma API compatível com OpenAI ou um Ollama em outro servidor, e teste uma conversa antes de abrir para usuários.
  4. Se usar RAG, comece com poucos documentos e acompanhe RAM, disco e tempo de ingestão; em uso multiusuário, avalie embeddings e extratores externos conforme as docs.
  5. Proteja o acesso com HTTPS, contas administrativas fortes e backup do volume de dados; não exponha serviços de modelo locais diretamente sem controle de rede.

Perguntas frequentes

Open WebUI precisa de GPU?

Não quando ele serve como interface para GPT, Claude, Gemini, OpenRouter ou outro endpoint remoto. A inferência acontece no provedor. A documentação oficial também oferece imagens CUDA, mas GPU só passa a ser relevante se você executar um modelo local, como Ollama, na mesma infraestrutura ou precisar de aceleração local.

Qual é o requisito mínimo oficial do Open WebUI?

O projeto não declara um mínimo universal de vCPU, RAM e disco. A Hostinger exibe para o template Open WebUI um KVM 1 com 1 vCPU, 4 GB de RAM e 50 GB de disco; é uma referência comercial de implantação, não uma promessa do projeto para qualquer uso. RAG, documentos, workers e modelo local podem pedir mais recursos.

Posso usar Open WebUI com Ollama em outro servidor?

Sim. O README oficial mostra a configuração de OLLAMA_BASE_URL para conectar a interface a um Ollama em outro servidor. Essa separação permite manter a VPS da interface mais leve e dimensionar a máquina de inferência conforme o modelo, a VRAM e a concorrência.

Quando não vale hospedar Open WebUI em VPS?

Não vale quando você não quer cuidar de atualizações, controles de acesso, backup e dados de chat. Também pode ser a escolha errada se o objetivo é só usar uma API em um chat pessoal sem precisar de interface compartilhada, RAG ou controle próprio. Para modelos locais grandes, uma VPS comum sem RAM ou GPU adequada não resolve o problema de inferência.

Procurando outro software? Veja todos os apps e onde hospedar cada um.

Relacionados