Simulador de custo de embedding: quanto custa vetorizar seus dados

Simule custo de gerar embeddings para seus documentos. Escolha modelo, volume e dimensão. Veja custo de API e armazenamento. Grátis, sem cadastro.

Como o simulador funciona

A ferramenta projeta o custo de vetorizar seus dados em 3 passos:

  1. Modelo de embedding: escolha entre OpenAI 3-small, OpenAI 3-large, Cohere embed-multilingual ou BGE-M3 local
  2. Número de documentos: quantos textos você quer vetorizar
  3. Tokens por documento , tamanho médio de cada documento em tokens

O resultado mostra o custo único de geração (API por token ou local grátis), o custo mensal de armazenamento no vector DB e o custo total em 12 meses. Tudo roda no navegador. Nada é enviado pra servidor.

Como o custo é calculado

A base matemática: tokens totais = documentos × tokens por documento. Custo de geração = tokens totais × preço por token (em USD, convertido pra BRL pela cotação do dólar).

Para armazenamento, cada documento vira um vetor. O custo do vector DB é cobrado por milhão de vetores por mês, variando conforme a dimensão do modelo (1.536 dimensões para o 3-small, 3.072 para o 3-large, 1.024 para o Cohere e 1.024 para o BGE-M3). Modelos locais como o BGE-M3 têm geração grátis, mas ainda pagam armazenamento.

Por que simular antes de vetorizar

Embedding é o primeiro passo de qualquer sistema RAG (busca semântica, recuperação por similaridade). Empresas subestimam o custo de armazenamento de longo prazo: o que parece barato na geração pode virar uma conta mensal pesada conforme a base cresce. A ferramenta responde: vale a pena pagar API comercial ou self-hostar um modelo local?

Se o custo de 12 meses for alto, vale considerar modelo local (BGE-M3) ou otimizar o chunking. O diagnóstico gratuito ajuda a definir a arquitetura ideal pra sua operação.

Quer montar um RAG de verdade?

A ferramenta dá uma estimativa de custo. O diagnóstico gratuito (30 min, online) avalia seus dados, volume real e arquitetura de vector DB mais econômica.

Agendar diagnóstico gratuito →

Simulador de custo de embedding

Preço por token em USD (tabela jul/2026). BGE-M3 roda na sua infra
Quantos textos você quer vetorizar
Tamanho médio de cada documento em tokens
Usado para converter custo de API em reais
Custo de geração (única)
R$
Armazenamento / mês
R$ / mês
Total em 12 meses
,
R$ / ano

Custo de geração = documentos × tokens × preço por token (USD convertido em BRL pela cotação informada). Armazenamento assume custo de vector DB de aproximadamente US$ 0,10 por milhão de vetores por mês (Pinecone, Weaviate Cloud, pgvector gerenciado), ajustado pela dimensão do modelo. Modelos locais (BGE-M3) têm geração grátis mas ainda pagam armazenamento. Preços de tabela jul/2026, sujeitos a alteração. Referência inicial, não é orçamento.

📖 Receba o guia "IA para PME em 30 dias" grátis

Checklist completo pra adotar IA na sua empresa. Sem spam, só conteúdo.

Um email. Sem cadastro chato. Cancela quando quiser.

Quer montar um RAG de verdade?

A simulação mostra o custo. A arquitetura certa economiza mais. Diagnóstico gratuito, 30 minutos.

Agendar diagnóstico gratuito →