Como a calculadora funciona
Você informa 3 variáveis: tipo de carga, modelo e usuários simultâneos: e a ferramenta estima o custo de hardware em 3 cenários lado a lado:
- Desktop com RTX 4090: GPU consumer de 24 GB VRAM, vaporiza em inference de modelos pequenos e médios.
- Servidor com A100: GPU datacenter de 80 GB VRAM, padrão para inference em escala e fine-tuning.
- Servidor com H100: GPU de última geração, para fine-tuning pesado e treinamento.
Cada cenário mostra capex (aquisição do equipamento completo), opex mensal (energia, espaço, depreciação) e TCO em 36 meses. O veredito aponta qual configuração atende sua carga pelo menor custo.
Tudo roda no navegador. Nada é enviado pra servidor.
Quando vale cada GPU
Não existe resposta universal: depende da carga e do modelo:
- RTX 4090 atende inference de modelos pequenos e médios (Mistral 7B, GPT-J 6B, Whisper) com poucos usuários simultâneos. Capex baixo (~US$ 2k pela GPU), mas VRAM limitada trava modelos grandes.
- A100 é o padrão datacenter para inference de modelos grandes (Llama 70B quantizado) e fine-tuning leve. Capex alto (~US$ 10k por GPU), mas escala bem.
- H100 vale para fine-tuning pesado e treinamento contínuo. Capex ainda maior (~US$ 30k por GPU), com ganho de 2-3× em throughput sobre a A100.
A calculadora usa preços de referência de julho de 2026 (RTX 4090 ~US$ 2k, A100 ~US$ 10k, H100 ~US$ 30k, energia R$ 0,75/kWh, cotação US$1 = R$ 5,50). Valide com orçamento real antes de comprar.
Quer ajuda pra escolher o hardware?
O número é metade da decisão. Equipe pra operar, espaço físico, refrigeração e redundância são a outra metade. Diagnóstico gratuito, 30 minutos, online.