Calculadora de Custos Claude
Estime seus custos mensais de API da Anthropic. Veja como o Claude Sonnet e o Haiku se comparam ao GPT, Gemini e outros.
Anthropic opção mais barata: Claude Haiku 4.5 por R$ 302,50/mês — o mais barato no geral é Llama 4 Maverick (R$ 38,50/mês)
Modelos Anthropic
| Model | Por Requisição | Monthly Total |
|---|---|---|
| melhorClaude Haiku 4.5 | R$ 0,0302 | R$ 302,50 |
| Claude Sonnet 5 | R$ 0,0907 | R$ 907,50 |
| Claude Opus 4.8 | R$ 0,1512 | R$ 1.512,50 |
Todos os Modelos (Comparação)
| Model | Por Requisição | Monthly Total |
|---|---|---|
| melhorLlama 4 Maverick | R$ 0,0039 | R$ 38,50 |
| GPT-5.6 Luna | R$ 0,0072 | R$ 71,50 |
| Nemotron 3 Ultra | R$ 0,0135 | R$ 134,75 |
| Gemini 2.5 Flash | R$ 0,0146 | R$ 145,75 |
| GLM-5.2 | R$ 0,0281 | R$ 280,50 |
| Claude Haiku 4.5 | R$ 0,0302 | R$ 302,50 |
| Gemini 2.5 Pro | R$ 0,0584 | R$ 584,38 |
| GPT-5.6 Terra | R$ 0,0715 | R$ 715,00 |
| Claude Sonnet 5 | R$ 0,0907 | R$ 907,50 |
| Kimi K3 | R$ 0,0907 | R$ 907,50 |
| Claude Opus 4.8 | R$ 0,1512 | R$ 1.512,50 |
| GPT-5.6 Sol | R$ 0,1788 | R$ 1.787,50 |
Como funciona o preço da API da Anthropic
A Anthropic cobra pelos modelos Claude por milhão de tokens, divididos entre entrada e saída, e — como na maioria dos provedores — os tokens de saída custam mais que os de entrada, porque gerar texto exige mais processamento do que lê-lo. Esta calculadora multiplica sua média de tokens de entrada e saída por requisição pela tarifa atual do modelo Claude escolhido, e depois multiplica pelo volume mensal esperado de requisições. A Anthropic também oferece cache de prompt, que pode reduzir bastante o custo de prompts de sistema ou contextos longos repetidos quando há acerto de cache, além de processamento em lote com desconto adicional para tarefas assíncronas — nenhum dos dois é aplicado aqui, então esta é uma estimativa de preço cheio, no pior caso.
Escolhendo o tier certo do Claude para cada tarefa
A Anthropic vende capacidade em camadas, e a diferença de preço entre elas é grande o bastante para decidir sua arquitetura. O Haiku foi feito para tarefas volumosas e bem definidas — classificação, extração, roteamento, respostas curtas — com tarifa por token que é uma fração pequena da dos modelos maiores. O Sonnet é o cavalo de batalha para trabalho pesado de raciocínio: código, análise, escrita longa. A pergunta prática raramente é "qual modelo é o melhor", e sim "qual é o tier mais barato que passa na minha barra de qualidade" — e o jeito honesto de responder é rodar seu próprio conjunto de testes em cada tier e comparar falhas, não impressões.
Um modelo mental útil: se a tarefa cabe inteira no prompt — formato fixo, regras claras, sem julgamento —, ela provavelmente pertence ao Haiku. No momento em que a tarefa exige pesar trade-offs ou sustentar uma cadeia longa de raciocínio, orce com as tarifas do Sonnet na estimativa acima.
A economia do prompt caching
O prompt caching é o desconto mais subaproveitado da Anthropic. Você paga um pequeno prêmio para gravar um prefixo de prompt no cache, e as requisições seguintes que reutilizam exatamente aquele prefixo o leem com desconto grande — na casa de uma ordem de grandeza mais barato que entrada normal. O porém é a vida útil do cache: entradas expiram após alguns minutos de inatividade, então o desconto só se concretiza quando as requisições chegam próximas umas das outras.
Esse formato serve quase perfeitamente a três cargas: chatbots com system prompt grande e tráfego constante, aplicações de RAG que fixam o mesmo contexto de referência em muitas perguntas, e agentes que relêem os mesmos documentos numa sessão. Se o seu tráfego é esparso — uma requisição a cada dez minutos —, o cache expira entre chamadas e o prêmio de escrita vira puro desperdício. Estime com o preço cheio da calculadora acima e trate o caching como otimização a validar com tráfego real.
Dicas de orçamento específicas do Claude
Três hábitos mantêm a fatura da Anthropic previsível. Defina max_tokens de propósito — é um teto rígido de custo por requisição, e defaults generosos autorizam respostas caras em silêncio. Vigie o tamanho das conversas: a janela de contexto grande do Claude facilita carregar o histórico inteiro da sessão em cada requisição, e tudo isso é cobrado como entrada a cada turno. E direcione trabalho assíncrono para a Batch API, que corta o preço de jobs tolerantes a atraso mais ou menos pela metade.
Para conferir se o Claude é mesmo a melhor casa para a sua carga, rode os mesmos números na calculadora de custos da OpenAI e no comparativo GPT vs Claude — o vencedor muda com frequência conforme a proporção entrada/saída. Para o confronto completo, com mapeamento de tiers e diferenças de cache, leia Claude ou ChatGPT: qual é melhor no custo.
O Claude ao lado das alternativas, tier por tier
A Anthropic precifica três tiers na mesma janela de 200k tokens, por milhão de tokens (entrada / saída): Opus 4.8 a US$ 5,00 / US$ 25,00, Sonnet 5 a US$ 3,00 / US$ 15,00 e Haiku 4.5 a US$ 1,00 / US$ 5,00. O Sonnet 5 ainda carrega uma promoção de lançamento de US$ 2,00 / US$ 10,00 até 31 de agosto de 2026 — por isso uma cotação feita em julho pode não bater com outra feita em setembro.
Os equivalentes mais próximos na OpenAI são GPT-5.6 Sol a US$ 5,00 / US$ 30,00, Terra a US$ 2,00 / US$ 12,00 e Luna a US$ 0,20 / US$ 1,20 — estes dois últimos reprecificados para baixo em 30 de julho de 2026. No tier de topo o Claude é mais barato na saída (US$ 25,00 contra US$ 30,00), o que pesa em trabalho de geração — redação, resumo, escrita de código. Mas o corte de julho virou a mesa nos tiers de baixo: o Terra agora fica abaixo do Sonnet 5 dos dois lados, e o Luna sai cerca de 5 vezes mais barato que o Haiku 4.5 na entrada e 4 vezes na saída. Onde a OpenAI também abre vantagem é no contexto: 1,05M tokens contra os 200k do Claude, relevante só se você realmente joga corpora inteiros numa chamada. Fora das duas, o Kimi K3 empata com o Sonnet em US$ 3,00 / US$ 15,00 com janela de 1M, e o GLM-5.2 (US$ 1,40 / US$ 4,40) fica abaixo do Haiku na saída. O guia tier a tier aprofunda a escolha.
Três cargas reais de Claude, precificadas
Um assistente de suporte. Prompt de sistema de 1.200 tokens mais 300 tokens de mensagem do usuário, respondendo em cerca de 250 tokens, 20 mil vezes por mês. No Haiku 4.5 isso dá aproximadamente 30M tokens de entrada e 5M de saída — cerca de US$ 30 na entrada e US$ 25 na saída, ou seja US$ 55 por mês. O mesmo volume no Opus 4.8 custa uns US$ 150 de entrada e US$ 125 de saída: US$ 275, cinco vezes mais por uma tarefa que o Haiku normalmente resolve bem.
Um resumidor de documentos. Relatório de 40k tokens na entrada, resumo de 1.500 tokens na saída, 200 documentos por mês. Sonnet 5 no preço cheio: 8M tokens de entrada (US$ 24) e 300k de saída (US$ 4,50), algo como US$ 28,50 — menos de US$ 10 enquanto durar a promoção. Nossa calculadora de resumo de PDF modela esse formato com mais detalhe.
Um agente de código. São cargas pesadas na saída e iterativas: 15k de entrada, 4k de saída, 500 execuções por mês. No Sonnet 5 são 7,5M de entrada (US$ 22,50) e 2M de saída (US$ 30) — cerca de US$ 52,50. Coloque em cache as partes repetidas do prompt e a entrada dos três exemplos cai perto de 90%.
Perguntas frequentes
Qual a diferença de preço entre Claude Sonnet e Claude Haiku?
O Sonnet é o modelo intermediário da Anthropic, equilibrando capacidade e custo, enquanto o Haiku é a camada mais rápida e barata, voltada a tarefas de alto volume e baixa latência. O Haiku geralmente custa uma fração do preço do Sonnet por token — veja a tabela de comparação de modelos acima para as tarifas atuais.
O cache de prompt muda meu custo real?
Sim, de forma significativa para cargas de trabalho que repetem o mesmo prompt de sistema ou contexto longo entre requisições. Esta calculadora não aplica descontos de cache, então sua conta real provavelmente será menor se você usar esse recurso.
Esses preços são oficiais?
Os preços vêm do feed de preços em tempo real do OpenRouter, com cache de 24 horas, e um valor fixo de reserva caso o feed fique indisponível. Sempre confirme o preço atual na página oficial da Anthropic antes de planejar gastos em produção.
Quando o prompt caching não ajuda?
Quando as requisições são espaçadas, quando os prefixos variam entre chamadas (qualquer edição pequena quebra o aproveitamento) ou quando o system prompt é curto demais para o prêmio de escrita compensar. Caching recompensa prefixos estáveis e tráfego constante.
A janela de contexto grande do Claude sai mais cara?
A janela em si não custa nada — você paga só pelos tokens que envia de fato. O risco é comportamental: janela grande convida a enfiar mais contexto do que a tarefa precisa, e cada um desses tokens é cobrado como entrada em toda requisição que o inclui.
A promoção de lançamento do Sonnet 5 entra na estimativa?
A calculadora cota a tarifa padrão de US$ 3,00 / US$ 15,00 por milhão de tokens, não a promocional de US$ 2,00 / US$ 10,00 que a Anthropic publicou até 31 de agosto de 2026. Isso mantém a estimativa conservadora: sua fatura durante a promoção vem menor do que o mostrado e não dá um salto inesperado quando a promoção acabar. Sempre confirme a tarifa vigente na página de preços da Anthropic antes de planejar em cima dela.
Quanto o processamento em batch economiza de verdade?
A Batch API da Anthropic dá 50% de desconto em entrada e saída para trabalho enviado de forma assíncrona, com resultado devolvido em até 24 horas. O desconto acumula com o prompt caching, então uma carga com cache e em batch pode ficar perto de um décimo do preço ingênuo por chamada. O preço disso é latência — batch serve para reprocessamento, classificação em massa e resumo offline, nunca para algo em que o usuário está esperando na tela.
Os tokens de raciocínio do Claude são cobrados?
São. Nos modelos com extended thinking ligado, os tokens de raciocínio gerados antes da resposta visível são cobrados como tokens de saída, na tarifa de saída. Uma resposta que mostra 500 tokens de texto pode ter produzido alguns milhares de tokens de raciocínio por trás. Se você habilitar o extended thinking, coloque aqui um número de saída bem acima do tamanho da resposta visível.
Quer saber de onde vêm estes números? Leia nossa metodologia de preços.