Como o estimador funciona
O custo de rodar um modelo de linguagem (LLM) depende de 3 variáveis: volume de consultas, tamanho médio do prompt (input) e tamanho médio da resposta (output). Tokens são as unidades que o modelo processa — em média 1 token equivale a 0.75 palavra em português.
A ferramenta calcula:
- Tokens por mês = consultas/dia × 30 × (prompt + resposta)
- Custo USD/mês = tokens de input × preço input + tokens de output × preço output
- Custo BRL/mês = USD × R$ 5,50 (cotação de referência)
Os preços são por 1.000 tokens e refletem a tabela oficial de cada provedor em julho de 2026. Modelos open-source (Llama 3.1 70B via provedores como Together/Groq) aparecem com preço de API, não de hospedar você mesmo.
Por que estimar custo antes de implementar
Projeto de IA que parecia barato vira dor de cabeça quando o volume cresce. Chatbot que custa R$ 200/mês com 100 conversas vira R$ 8.000/mês com 5.000 conversas. A estimativa antes de implementar evita surpresa no fim do mês.
A ferramenta ajuda a comparar modelos: vale a pena pagar GPT-4o ou Claude 3.5 Sonnet responde igual por menos? A resposta depende do caso de uso. O diagnóstico gratuito ajuda a escolher.
Quer ajuda pra escolher e otimizar custo?
A ferramenta dá uma boa referência. Em 30 minutos a gente valida qual modelo encaixa no seu caso e como cachear/resumir pra reduzir custo em 50-80%.