Cole um prompt, escolha OpenAI, Claude ou Gemini e estime tokens, custo por chamada, custo diário e custo mensal antes de colocar uma automação em produção.
Simule uma chamada
Cole o texto, escolha o modelo e ajuste só o volume. Preço fica em avançado.
Ajustar dólar, cache e preços do modelo
Resultado
Estimativa para planejar orçamento antes de escalar uma rotina com IA.
| Item | Tokens | Preço | Custo |
|---|
Como calcular custo de IA por tokens
O custo de uma chamada de IA normalmente soma tokens de entrada e tokens de saída. A fórmula base é: (tokens de entrada / 1.000.000 × preço de input) + (tokens de saída / 1.000.000 × preço de output).
Se parte do prompt usa cache, os tokens cacheados podem ter preço menor. A calculadora permite simular esse efeito, mas mantém os campos de preço editáveis porque OpenAI, Anthropic e Google atualizam tabelas com frequência.
Quando usar esta calculadora
- Antes de lançar uma automação com ChatGPT, Claude ou Gemini.
- Para estimar custo de chatbot, SDR de WhatsApp, análise de documentos, resumo de reuniões ou geração de conteúdo.
- Para comparar modelo barato, modelo intermediário e modelo premium no mesmo volume de chamadas.
- Para explicar custo de IA para cliente sem depender de planilha manual.
Preços iniciais usados na calculadora
| Modelo | Input US$/1M | Cache US$/1M | Output US$/1M |
|---|
Valores revisados em agosto de 2026 a partir das páginas oficiais de preços. Antes de orçamento fechado, valide o modelo exato, região, modalidade e eventuais descontos de batch/cache.
Perguntas Frequentes
Esta calculadora conta tokens com precisão oficial?
Não. Ela usa uma estimativa local baseada em caracteres e palavras. Para cobrança real, use o contador/tokenizer oficial do provedor ou leia o campo de uso retornado pela API.
Por que o output costuma pesar mais no custo?
Em muitos modelos, o token de saída custa mais que o token de entrada. Por isso respostas longas, raciocínio interno, tools e retries podem aumentar bastante a conta.
Cache reduz custo de IA?
Pode reduzir quando você reaproveita uma parte estável do prompt, como instruções de sistema, documentação ou contexto que se repete. O desconto e a regra mudam por provedor.
Qual modelo escolher para economizar?
Comece pelo modelo mais barato que resolve a tarefa com qualidade aceitável. Use modelos premium para decisões críticas, código complexo, análise longa ou tarefas que falham muito em modelos econômicos.
Posso usar a calculadora para WhatsApp e atendimento?
Sim. Coloque o prompt de sistema, uma mensagem média do cliente e uma resposta média esperada. Depois multiplique pelo número de conversas ou mensagens por dia.