← Comparações // comparações · modelos de IA

Quanto custa cada modelo de IA hoje

retrato de 03/08/2026

Preço por milhão de tokens, entrada e saída, com a janela de contexto de cada modelo. Cada número desta página saiu da página oficial do fabricante, e cada página oficial está listada no fim com a data em que foi consultada.

A régua desta página. Nenhum benchmark nosso, nenhum ranking de qualidade. Só preço e limite publicados pelo próprio fabricante. Onde a fonte oficial não publica um número, a tabela diz que não publica em vez de estimar.

O que é token, entrada e saída

Modelo de linguagem não cobra por palavra nem por pergunta. Ele cobra por token, que é o pedaço em que o texto é picado antes de ser processado. Em português, um token costuma ser uma palavra curta ou um pedaço de palavra longa.

O preço vem sempre em dois números, e essa separação é a parte que mais confunde quem chega agora:

  • Entrada é tudo que você manda para o modelo: a pergunta, o histórico da conversa, os documentos anexados, as instruções do sistema.
  • Saída é o que ele escreve de volta.

Saída custa de cinco a seis vezes mais que entrada em quase toda a tabela abaixo. Só que a maioria dos usos reais manda muito mais texto do que recebe, então quem olha só o número da saída erra a conta na direção errada.

A janela de contexto

A janela é quanto texto cabe de uma vez em uma chamada, contando entrada e saída juntas. Um milhão de tokens dá, por alto, algo perto de meio milhão de palavras em português. Quando o assunto passa da janela, você precisa cortar, resumir ou dividir o trabalho, e é aí que aplicação com histórico longo começa a doer.

Repare que janela grande e preço baixo deixaram de ser opostos. Na tabela, o modelo mais barato da lista é também um dos de janela maior.

A tabela, em dólares por milhão de tokens

modeloentradasaídajanelasaída máx.
Anthropic
Claude Fable 5 $10$50 1M128k
Claude Opus 5 $5$25 1M128k
Claude Sonnet 5 $3$15 1M128k
Claude Haiku 4.5 $1$5 200k64k
OpenAI
GPT-5.6 Sol $5$30 1,05M128k
GPT-5.6 Terra $2$12 1,05M128k
GPT-5.6 Luna $0,20$1,20 1,05M128k
GPT-5.5 $5$30 272knão publicado
Google
Gemini 3.1 Pro (preview) $2 até 200k
$4 acima
$12 até 200k
$18 acima
não publicadanão publicada
Gemini 3.6 Flash $1,50$7,50 não publicadanão publicada
Gemini 3.5 Flash $1,50$9 não publicadanão publicada
Gemini 3.5 Flash-Lite $0,30$2,50 não publicadanão publicada
Gemini 3.1 Flash-Lite $0,25$1,50 não publicadanão publicada

Preço de tabela, sem descontos. Todos os fabricantes cobram menos em processamento em lote e em contexto reaproveitado, e essas contas ficam de fora daqui de propósito porque dependem do seu uso. O Gemini 3.1 Flash-Lite tem um preço de entrada mais alto para áudio, $0,50, que também ficou de fora da linha para não misturar duas unidades na mesma célula.

Três leituras que a tabela entrega

Mesma entrada, saída diferente

Claude Opus 5 e GPT-5.6 Sol cobram os mesmos $5 pela entrada e se separam na saída: $25 contra $30. Em uma aplicação que lê muito e escreve pouco, essa diferença quase some. Em uma que gera relatório longo, ela aparece na fatura todo mês.

Barato deixou de significar janela curta

GPT-5.6 Luna cobra $0,20 na entrada com janela de 1,05 milhão de tokens. Claude Haiku 4.5 cobra $1 com 200 mil. O da faixa mais barata da lista é o que aguenta o texto mais longo.

Preço de introdução tem prazo

O Claude Sonnet 5 tem preço de tabela de $3 e $15, e a Anthropic publica um preço de introdução de $2 e $10 valendo até 31 de agosto de 2026. Quem monta orçamento anual em cima do preço de hoje leva um susto em setembro.

O que esta tabela não mede

Preço não diz qualidade. Nada nesta página afirma que um modelo raciocina melhor, escreve melhor ou erra menos que outro, porque isso exige avaliação própria e comparável, e nós não temos essa medida.

Também ficam de fora a velocidade de resposta, os limites de uso por minuto, a disponibilidade em cada nuvem e o custo de contexto reaproveitado. São quatro coisas que mudam bastante a conta real e que nenhuma tabela de preço resolve por você.

Por que o Google aparece com buracos. A página oficial de preços do Google publica o valor de cada modelo, mas não publica a janela de contexto ao lado, e a página de modelos não traz o limite de tokens. Preferimos escrever "não publicada" a repetir um número que a gente viu em outro lugar sem data.

Como fazer a conta do seu caso

  1. Meça a sua proporção antes de escolher. Pegue dez chamadas reais e some quantos tokens entraram e quantos saíram. Com a proporção na mão, os dois preços viram um número só, e a comparação para de depender de qual coluna você olhou primeiro.
  2. Some o histórico à entrada. Em conversa com muitas idas e voltas, a entrada cresce a cada turno porque o histórico inteiro vai junto. Aplicação de chat costuma gastar em entrada muito mais do que a primeira estimativa sugere.
  3. Confira a janela contra o seu pior caso. Não o documento médio, o maior. É o maior que quebra.
  4. Anote a data da cotação. Esta tabela é de 3 de agosto de 2026 e vai envelhecer. Tabela de preço sem data ensina coisa errada com cara de verdade.

Fontes

  • Models overview. Documentação da Anthropic, consultada em 03/08/2026. De onde saem preço, janela e saída máxima de todos os modelos Claude, incluindo a nota do preço de introdução do Sonnet 5.
  • Pricing. Documentação da OpenAI, consultada em 03/08/2026. De onde saem os preços dos GPT-5.6 e do GPT-5.5.
  • Models. Documentação da OpenAI, consultada em 03/08/2026. De onde sai a janela de 1,05M e a saída máxima de 128k dos GPT-5.6.
  • Gemini API pricing. Documentação do Google, atualizada em 30/07/2026 e consultada em 03/08/2026. De onde saem os preços do Gemini. Esta página não publica janela de contexto.

Uma honestidade sobre o levantamento. A janela de contexto dos modelos Gemini não entrou porque não a encontramos publicada em página oficial datada dentro do prazo desta edição. Assim que ela aparecer, atualizamos aqui e registramos a data da atualização.

Achou imprecisão? Fala com a gente que a gente corrige e registra a correção nesta página.

O aviso quando esta tabela mudar.

Preço de modelo muda sem aviso e quase sempre para os dois lados. Assine e receba a atualização desta página junto com a próxima comparação, sempre com as fontes na mesa.

Seu e-mail é usado só pra isso. Dá pra sair em um clique em qualquer mensagem, como está na política de privacidade.