Calculadora de Tokens

Cole seu texto para estimar a contagem de tokens e ver quanto custaria em todos os principais modelos de IA.

0

Tokens (est.)

0

Palavras

0

Caracteres

A contagem de tokens é uma estimativa baseada em ~4 caracteres por token (média em inglês). A tokenização real varia por modelo e idioma. Para contagens exatas, use o tokenizador de cada provedor.

Como funciona a contagem de tokens

Toda requisição a uma API de IA é cobrada em tokens, não em caracteres ou palavras — um token equivale a cerca de 4 caracteres de texto em inglês, mas isso varia por idioma e pelo tokenizador específico de cada provedor. Cole qualquer texto acima e nós estimamos sua contagem de tokens, mostrando quanto custaria como entrada ou como saída em cada modelo principal, para você ver a diferença de preço só pela forma como o mesmo conteúdo é usado. Isso é útil para dimensionar prompts, estimar custos de resumo, ou entender por que uma fatura veio mais alta que o esperado.

O que realmente consome seu orçamento de tokens

Prosa raramente é o problema. Os grandes consumidores são estrutura e repetição: chaves de JSON, aspas e colchetes são tokens, então um schema de resposta verboso pode dobrar o tamanho cobrado da mesma informação. Código é ainda mais denso — indentação, símbolos e identificadores em camelCase viram mais tokens por caractere visível do que texto corrido.

Idioma pesa mais do que se imagina. Os tokenizadores mais comuns foram treinados majoritariamente em inglês, então textos em português consomem tipicamente 20-40% mais tokens pelo mesmo conteúdo, e línguas de escrita não latina podem usar várias vezes mais. Se o seu produto atende usuários em português, orce esse overhead — o mesmo template de prompt custa, literalmente, mais caro por requisição do que o original em inglês.

Regras de bolso que valem memorizar

Um punhado de conversões resolve a maioria das estimativas do dia a dia. Um token equivale a cerca de quatro caracteres de inglês, então 100 tokens dão mais ou menos 75 palavras. Uma página densa de texto fica em torno de 500 tokens; um livro de 300 páginas, na casa dos 150.000 — por isso livros inteiros só cabem nas maiores janelas de contexto (veja a calculadora de janela de contexto). Ler os números ao contrário também ajuda: uma resposta de 400 palavras gerou uns 530 tokens de saída, cobrados na tarifa cara. Estimativa primeiro, tokenizador depois: quando o número importa de verdade para contrato ou orçamento, confirme no tokenizador oficial do provedor.

Cinco jeitos de reduzir o consumo de tokens

Primeiro, enxugue o system prompt — ele é reenviado em toda requisição, então cada frase cortada se paga em todo o tráfego futuro. Segundo, peça respostas curtas e estruturadas: formato de saída rígido com limite explícito de tamanho costuma cortar os tokens de saída pela metade. Terceiro, limpe boilerplate antes de enviar — tags HTML, cabeçalhos, rodapés e menus de páginas raspadas são cobrados como conteúdo. Quarto, resuma ou trunque o histórico da conversa em vez de reenviá-lo inteiro. Quinto, case o modelo com a tarefa: o preço por token varia uma ordem de grandeza entre modelos, e a calculadora de custos da OpenAI mostra como as mesmas contagens viram faturas mensais bem diferentes. A história completa de como palavras viram tokens — e por que 1.000 palavras nunca são 1.000 tokens — está no nosso guia de tokens.

Quanto custam mil tokens em cada modelo

Contagem de tokens só vira dinheiro quando você pendura um preço nela. Veja quanto custam 1.000 tokens de entrada e 1.000 de saída em todo o catálogo, nos preços de tabela de agosto de 2026, por milhão de tokens (entrada / saída).

No topo: GPT-5.6 Sol US$ 5,00 / US$ 30,00 e Claude Opus 4.8 US$ 5,00 / US$ 25,00. O miolo de trabalho: Claude Sonnet 5 US$ 3,00 / US$ 15,00, Kimi K3 US$ 3,00 / US$ 15,00, GPT-5.6 Terra US$ 2,00 / US$ 12,00 e GLM-5.2 US$ 1,40 / US$ 4,40. A ponta econômica: Gemini 2.5 Pro US$ 1,25 / US$ 10,00, Claude Haiku 4.5 US$ 1,00 / US$ 5,00, Nemotron 3 Ultra US$ 0,50 / US$ 2,20, Gemini 2.5 Flash US$ 0,30 / US$ 2,50, Llama 4 Maverick US$ 0,20 / US$ 0,60 e GPT-5.6 Luna US$ 0,20 / US$ 1,20 — Luna e Terra foram cortados em 80% e 20% em 30 de julho de 2026, e é por isso que o Luna aparece hoje no fim da tabela, e não no meio.

Divida por mil para o valor por 1k: 1.000 tokens de saída custam US$ 0,030 no Sol e US$ 0,0006 no Maverick — 50 vezes de diferença sobre a mesma contagem. É aí que está o dinheiro, não no tokenizador. Precifique seus volumes nas calculadoras da OpenAI e do Claude.

Textos reais e suas contagens de tokens

Proporção abstrata a gente esquece, então aqui vão formatos com que você provavelmente trabalha. Uma mensagem do tamanho de um tuíte, uns 280 caracteres, fica perto de 70 tokens. Um parágrafo denso de 100 palavras em inglês dá entre 130 e 140 tokens; o mesmo parágrafo em português costuma custar 15% a 25% a mais, porque acentos e palavras longas se quebram em mais pedaços. Um memorando de uma página, 500 palavras, dá cerca de 650 a 700 tokens.

Subindo a escala: um post de blog de 3.000 palavras dá aproximadamente 4.000 tokens, um relatório de 30 páginas cerca de 20.000, e um livro de 300 páginas algo perto de 200.000 tokens — exatamente a janela de contexto cheia do Claude Opus 4.8, e mais ou menos um quinto da janela de 1,05M do GPT-5.6.

Código se comporta de outro jeito: indentação, chaves e identificadores fragmentam muito, então 100 linhas de TypeScript costumam custar de 1.200 a 1.500 tokens, bem mais do que 100 linhas de prosa. Veja o que cabe em cada modelo na calculadora de janela de contexto, ou raciocine em páginas com quantas páginas cabem.

Perguntas frequentes

4 caracteres por token é preciso para qualquer idioma?

Não — é uma aproximação razoável para o inglês. Idiomas com escritas diferentes, como chinês, japonês ou coreano, ou com muito uso de caracteres especiais, costumam usar mais tokens por caractere. Para contagens exatas, use o tokenizador oficial do provedor.

Por que o mesmo texto tem preços diferentes como entrada e saída?

Tokens de saída são gerados um de cada vez e custam mais processamento por token do que ler a entrada, então os provedores cobram mais pela saída. A mesma quantidade de texto pode custar várias vezes mais se o modelo a gera, em vez de você enviá-la como prompt.

Formatação como markdown ou código afeta a contagem de tokens?

Sim. Caracteres estruturais, sintaxe de código e espaços repetidos também consomem tokens, assim como texto normal. Texto denso e rico em informação é mais eficiente em tokens do que um texto pouco formatado com a mesma quantidade de palavras.

Imagens e áudio também contam como tokens?

Sim, de forma convertida. Modelos com visão traduzem imagens em equivalentes de tokens conforme a resolução, e modelos de áudio cobram por token de áudio ou por minuto, dependendo do provedor. Essas tarifas costumam ser separadas do preço de tokens de texto — para cargas multimodais, confira a página de preços do provedor.

O mesmo texto custa a mesma quantidade de tokens em todo modelo?

Não. Cada família de modelos traz o próprio tokenizador, então o mesmo texto se divide de forma diferente — os números daqui são uma estimativa bem calibrada, não a contagem exata de cada fornecedor. Diferenças de 5% a 15% entre famílias são normais, e maiores em código, escritas não latinas e texto muito acentuado. Para trabalho crítico de cobrança, conte com o tokenizador do próprio provedor e use esta página como número de planejamento.

Por que português custa mais tokens que inglês?

Os tokenizadores são treinados em corpora bastante enviesados para o inglês, então palavras comuns em inglês viram um token só enquanto suas equivalentes em português se quebram em duas ou três peças. Os acentos acrescentam fragmentação própria. Na prática o mesmo conteúdo custa de 15% a 25% mais tokens em português, ou seja: o mesmo prompt é realmente mais caro de rodar — vale contabilizar isso no orçamento de um produto bilíngue.

Espaços e pontuação são cobrados?

Sim. Os tokenizadores geralmente grudam o espaço na palavra seguinte, então o espaço em branco entra na contagem em vez de ser de graça. Pontuação, quebras de linha e sintaxe de markdown também consomem tokens. É por isso que prompts muito formatados — tabelas, listas longas, JSON com indentação generosa — custam mais que a mesma informação escrita de forma corrida.

Quer saber de onde vêm estes números? Leia nossa metodologia de preços.