Runzos

VPS para Weaviate: onde hospedar e quanto custa de verdade

Weaviate é um banco de dados vetorial open source para guardar objetos e embeddings, fazer busca semântica, busca híbrida e RAG. Em uma VPS, ele atende aplicações que precisam controlar dados e consulta vetorial. Aqui você compara onde hospedar o Weaviate e entende o que realmente dimensiona a máquina: quantidade e dimensão dos vetores, índice e modelo de embeddings.

Backend e banco de dadosself-hosted

Qual porte de Weaviate você vai rodar?

leve— vCPU— RAM— discoteste, avaliação ou corpus ainda não dimensionado; o Weaviate não publica mínimo universal de vCPU, RAM ou disco para uma VPS
medio— vCPU3 GB RAM— discoreferência oficial para 1 milhão de vetores float32 de 384 dimensões mantidos em memória com HNSW; CPU e disco dependem da carga e dos dados
pesado— vCPU6 GB RAM— discoreferência calculada pela regra oficial para 2 milhões de vetores float32 de 384 dimensões em memória com HNSW; não é uma promessa por número de usuários

Weaviate não publica uma configuração mínima universal de vCPU, RAM ou disco. Os valores 0 indicam “não informado oficialmente”, não ausência de recursos. A própria documentação mostra que CPU afeta velocidade de importação e consultas, enquanto RAM define o tamanho do conjunto de vetores que fica em memória. O cálculo oficial chega a 3 GB para 1 milhão de vetores float32 de 384 dimensões com a regra de dobrar a memória dos vetores; 6 GB apenas dobra esse cenário. Disco depende de objetos, índice, backups e compressão; use SSD e volume persistente. O banco Weaviate não usa GPU. GPU é opcional somente para contêineres separados de modelos locais, como text2vec-transformers; embeddings e LLMs por API não exigem GPU na VPS.

O que o Weaviate faz

Weaviate não é o modelo de IA: ele guarda objetos e vetores para que um aplicativo recupere contexto por significado. Em um RAG, documentos viram embeddings, entram em uma coleção e os resultados mais próximos seguem para o LLM. Isso permite usar OpenAI, Claude, Gemini ou outro provedor por API sem colocar uma GPU na VPS. Uma máquina com GPU só entra no desenho se você também decidir rodar localmente o contêiner de inferência ou o modelo de embeddings.

O custo do Weaviate cresce com o corpus, não com o rótulo “IA”. A documentação informa que o HNSW mantém o índice em memória e que a conta depende de quantidade de vetores, dimensões e conexões. Antes de subir de plano, meça o número de objetos, a dimensão do embedding, latência e uso de RAM durante importação. Para economizar memória, avalie compressão ou índice baseado em disco no seu conjunto real. Não trate o container como descartável: use volume persistente, desative acesso anônimo fora de avaliação, configure autenticação e teste backups.

Como instalar

  1. Estime quantidade de vetores, dimensões do embedding, crescimento do corpus e se o índice ficará em memória; isso define a VPS melhor que uma tabela genérica.
  2. Escolha uma VPS Linux com SSD e armazenamento persistente; evite NFS ou sistemas semelhantes para o volume de dados do Weaviate.
  3. Na Hostinger, comece pelo template da aplicação; em outro provedor, siga o Docker Compose oficial e monte o volume em /var/lib/weaviate.
  4. Desative acesso anônimo, configure API keys e RBAC; publique HTTP e gRPC por proxy reverso com HTTPS em subdomínios adequados.
  5. Crie uma coleção, importe uma amostra real, acompanhe RAM, CPU, disco e latência e teste backup e restauração antes de liberar dados de produção.

Perguntas frequentes

Weaviate precisa de GPU?

O banco Weaviate não usa GPU. A documentação explica que GPU pode ser útil em contêineres isolados de modelos locais, como text2vec-transformers. Se seus embeddings ou LLM usam OpenAI, Claude, Gemini ou outro serviço por API, a VPS do Weaviate não precisa de GPU por causa deles.

Quanta RAM preciso para 1 milhão de vetores no Weaviate?

A documentação oferece uma regra de bolso para vetores mantidos em memória: dobrar a memória dos vetores. No exemplo oficial, 1 milhão de vetores float32 de 384 dimensões chega a 3 GB. Esse número não inclui automaticamente objetos, outros serviços, backups, seu modelo de embedding, nem garante capacidade por usuário.

Por que a CPU do Weaviate importa?

A documentação aponta que CPU afeta diretamente a velocidade de consultas e importação, mas não o tamanho máximo do conjunto de dados. Mais CPU faz sentido quando a utilização fica alta durante importação ou quando você precisa aumentar consultas por segundo; a RAM é o recurso que acompanha o tamanho dos vetores em memória.

Quando não vale hospedar Weaviate em VPS?

Não vale para um protótipo que não precisa de domínio, persistência, rede privada ou controle operacional, nem quando não há responsável por atualização, autenticação, backups e monitoramento. Também não escolha uma VPS sem antes saber o tamanho e a dimensão dos vetores: banco vetorial mal dimensionado vira custo e complexidade sem ganho.

Fontes

Relacionados