De onde vêm os nossos números
Todo número publicado no LLMScout.tech vem de algum lugar específico, e esta página diz qual. Ela cobre os três tipos de dado que divulgamos: preços de API por token, preços de GPU por hora e algumas constantes de estimativa que são nossas, não de terceiros. Cada fonte abaixo é uma página pública que você pode abrir e conferir.
Como um preço chega até a tela
Os preços de modelo são resolvidos quando você abre uma calculadora. O site chama o endpoint /api/model-prices, que lê o catálogo público do OpenRouter e converte as taxas por token nos valores por milhão que as calculadoras usam. A resposta fica em cache por 24 horas: em operação normal, o preço à sua frente foi buscado há no máximo um dia.
Se a requisição falhar ou não listar um modelo que acompanhamos, a calculadora cai na tabela fixa do nosso catálogo. Essas taxas foram verificadas em 2026-08-04 nas páginas oficiais de preço de cada provedor, e cada modelo carrega a própria data de verificação — o controle é por modelo, não um carimbo único de "última atualização" do site. São retratos conservadores, não dados ao vivo.
A conversão de moeda é um feed separado: a cotação USD→BRL vem da AwesomeAPI via /api/exchange-rate, com cache de uma hora e taxa padrão fixa como último recurso. Os provedores publicam em dólar, então todo valor em reais aqui é conversão nossa — nunca uma taxa cotada pelo provedor.
Provedores de modelo que acompanhamos
O catálogo cobre hoje 12 modelos de 7 provedores. A fonte autoritativa de cada um é a documentação de preços do próprio provedor, com link na tabela abaixo. Dois deles publicam pesos abertos em vez de preço de API de primeira parte: são servidos por vários hosts a taxas diferentes, então exibimos uma taxa hospedada representativa, não um preço oficial.
| Provedor | Modelos acompanhados | Página oficial de preço | Verificado em |
|---|---|---|---|
| OpenAI | GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna | platform.openai.com/docs | 2026-07-20, 2026-08-04 |
| Anthropic | Claude Opus 4.8, Claude Sonnet 5, Claude Haiku 4.5 | anthropic.com/pricing | 2026-07-20 |
| Gemini 2.5 Pro, Gemini 2.5 Flash | ai.google.dev/gemini-api | 2026-07-20 | |
| Meta pesos abertos — taxa hospedada | Llama 4 Maverick | openrouter.ai/meta-llama | 2026-07-20 |
| Z.ai | GLM-5.2 | docs.z.ai/guides | 2026-07-20 |
| Moonshot AI | Kimi K3 | platform.moonshot.ai/docs | 2026-07-20 |
| NVIDIA pesos abertos — taxa hospedada | Nemotron 3 Ultra | build.nvidia.com/models | 2026-07-20 |
As ressalvas de cada modelo ficam junto ao preço: tarifas promocionais, faixas mais caras acima de um limite de contexto e descontos de cache. O Claude Sonnet 5 tem promoção de lançamento de US$ 2/US$ 10 por milhão até 31/08/2026, abaixo da taxa padrão que exibimos; o Gemini 2.5 Pro custa mais acima de 200 mil tokens.
Preços de GPU e computação em nuvem
Os preços de GPU funcionam de outro jeito. Não existe API pública e gratuita que agregue preços de GPU sob demanda entre hyperscalers e nuvens especializadas, então a calculadora de GPU não tem feed ao vivo: os valores são um retrato pesquisado à mão. Lemos a página de preços de cada provedor em julho de 2026 — a checagem registrada é de 2026-07-06 — e anotamos a tarifa por hora. Nada aqui se atualiza sozinho.
O retrato cobre 8 provedores em duas categorias: hyperscalers e nuvens especializadas em GPU. Cada entrada nomeia a instância exata, porque "o preço de uma H100" não diz nada sem saber se é um nó de 8 GPUs dividido por oito, uma instância única ou um marketplace. As aproximadas são aquelas em que o provedor não publica tarifa sob demanda isolada: o número vem de instância multi-GPU, SKU fracionário ou faixa de marketplace.
- AWS hyperscaler · 4 entradas de GPU · 1 aproximada
- Google Cloud hyperscaler · 3 entradas de GPU · 1 aproximada
- Azure hyperscaler · 3 entradas de GPU · 2 aproximadas
- RunPod nuvem de GPU · 6 entradas de GPU
- Lambda Labs nuvem de GPU · 4 entradas de GPU
- CoreWeave nuvem de GPU · 2 entradas de GPU · 1 aproximada
- Vast.ai nuvem de GPU · 3 entradas de GPU · 3 aproximadas
- Paperspace nuvem de GPU · 4 entradas de GPU
Como esses preços são estáticos, confirme a tarifa atual na página do provedor antes de fechar um orçamento — cada linha tem link para a própria fonte, aqui e também na calculadora de custo de GPU em nuvem.
Estimativas nossas, não dados de terceiros
Alguns números daqui não vêm de ninguém: são estimativas nossas, e preferimos dizer isso a deixá-los passar por dado de fornecedor.
O primeiro é 400 tokens por página de PDF, constante por trás da calculadora de resumo de PDF e da tabela de capacidade de páginas. Ela pressupõe texto corrido denso: tabelas, notas de rodapé ou duas colunas ficam acima; um slide esparso, bem abaixo. O segundo é 500 tokens para uma página densa na calculadora de janela de contexto. São números redondos de planejamento, não medições dos seus documentos.
Você vê os dois em ação na calculadora de custo de resumo de PDF, calculadora de janela de contexto e na tabela de capacidade de páginas.
Contagens de token são aproximações: tokenizadores variam entre famílias de modelo, e o mesmo texto é tokenizado diferente em cada idioma — o português costuma gastar mais tokens que o inglês. Trate toda estimativa daqui como número de planejamento com margem, não como previsão de fatura.
O que essas fontes não conseguem dizer
Preços de tabela são só uma parte da fatura real: não incluem descontos de batch, uso comprometido, contratos enterprise, camadas gratuitas, armazenamento nem tráfego de saída. Nossas calculadoras precificam o caminho sob demanda — por onde a maioria dos projetos começa, e o único que todo provedor publica abertamente.
Não recebemos feed de preços de nenhum provedor, não temos relação comercial com as empresas listadas aqui e não somos endossados por elas. Quando um provedor muda um preço, ficamos sabendo lendo a página dele — igual a você. É por isso que publicamos os links.
Correções
Um preço errado é o bug mais grave deste site. Se algum número não bater com o que o provedor publica hoje, escreva para contato@lwforge.com com a página, o modelo ou a GPU e o valor esperado — conferimos na fonte oficial e corrigimos, normalmente em poucos dias.
Para entender como esses preços viram estimativas de custo — fórmulas, arredondamentos e premissas de cada calculadora — veja nossa metodologia de preços.