← Todos os artigos

Inteligência Artificial · 11 min · 18 de agosto de 2026

Quanto custa cada IA em 2026: comparamos GPT, Claude, Gemini e as chinesas

Em 2026, o preço de usar IA por API varia mais de 200 vezes entre o modelo mais barato e o mais caro do mercado — e a diferença não é só entre marcas americanas, é também entre elas e as chinesas, que mudaram de estratégia de preço nas últimas semanas. Este guia reúne o preço atual de GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Kimi e GLM num só lugar, com exemplo real de custo por tarefa e um jeito prático de escolher sem se perder na tabela.

Quanto custa cada IA em 2026: comparamos GPT, Claude, Gemini e as chinesas

O preço de usar IA por API varia mais de 200 vezes entre o modelo mais barato e o mais caro do mercado, em agosto de 2026. E a linha que separava "americano caro e bom" de "chinês barato e ok" ficou bem mais embaçada nas últimas semanas — dos dois lados.

Reunimos o preço atual de GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Kimi e GLM num só lugar, com exemplo real de quanto custa uma tarefa comum e um jeito prático de escolher sem se perder em tabela de token.

Os dois lados se mexeram ao mesmo tempo

Em 13 de agosto de 2026, a DeepSeek lançou o V4-Pro e aumentou o preço da própria API em até 1.100%. Cinco dias depois, o mercado segue absorvendo o efeito. Ao mesmo tempo, do outro lado do mundo, a OpenAI vinha cortando preço da própria linha justamente para pressionar os concorrentes chineses.

Resultado: o mercado não está mais dividido entre "barato chinês" e "caro americano". Está disputado tier por tier, com modelo de cada lado competindo direto no mesmo intervalo de preço.

A tabela completa, por faixa de preço

Valores em dólar por milhão de tokens — entrada / saída. Câmbio de referência: US$ 1 ≈ R$ 5,70.

Faixa premium

Claude Fable 5 — Anthropic
US$ 10 / US$ 50
GPT-5.6 Sol — OpenAI
US$ 5 / US$ 30
Claude Opus 5 — Anthropic
US$ 5 / US$ 25
Gemini 3.1 Pro — Google
US$ 2–4 / US$ 12–18

Faixa intermediária

Kimi K3 — Moonshot AI (China)
US$ 3 / US$ 15
GPT-5.6 Terra — OpenAI
US$ 2,50 / US$ 15
Claude Sonnet 5 — Anthropic (até 31/8/2026)
US$ 2 / US$ 10
Qwen3.8-Max — Alibaba (China)
US$ 2 / US$ 6
Grok 4.5 — xAI
US$ 2 / US$ 6
GLM-5.2 — Zhipu AI (China)
US$ 1,40 / US$ 4,40

Faixa econômica, alto volume

Claude Haiku 4.5 — Anthropic
US$ 1 / US$ 5
GPT-5.6 Luna — OpenAI
a partir de US$ 0,20 / US$ 1,20
DeepSeek V4-Flash — DeepSeek (China)
US$ 0,14 / US$ 0,28

O que essa tabela mostra de mais interessante: não existe mais "faixa americana" e "faixa chinesa" separadas. Os dois lados aparecem competindo lado a lado em cada faixa de preço, sem padrão fixo de quem lidera.

Quanto isso custa numa tarefa real

Preço por milhão de tokens é abstrato. O que importa é quanto custa a tarefa que você realmente precisa fazer.

Exemplo prático: resumir um documento de 4 mil tokens de entrada, gerando 500 tokens de saída — um contrato, um relatório, um laudo.

Modelo econômico
~US$ 0,0006 por documento
Para 1.000 documentos, isso é menos de US$ 1.
Modelo topo de linha
~US$ 0,0325 por documento
Para os mesmos 1.000 documentos, isso sobe pra cerca de US$ 32,50 — 54 vezes mais caro pela mesma tarefa.

A pergunta certa nunca é "qual o modelo mais barato" nem "qual o mais forte". É: essa tarefa específica precisa do raciocínio caro, ou o barato já resolve igual?

A estratégia que analistas recomendam: não escolha um só

Um ponto que se repete entre quem acompanha o mercado de perto: a melhor configuração de IA para uma empresa raramente é um único modelo. É uma estratégia de roteamento — mandar cada tarefa pro modelo certo, não pro modelo favorito.

Na prática: raciocínio complexo, análise de alto risco e tarefa que só acontece uma vez vão para o modelo caro. Classificação, extração de dado e qualquer tarefa repetitiva de alto volume vão para o modelo barato — muitas vezes um chinês, muitas vezes o tier de entrada de um americano.

Um detalhe técnico que engana comparação simples: a saída (output) é sempre mais cara que a entrada (input), porque gerar texto exige mais processamento que só interpretá-lo. Um chatbot com resposta longa pode ter 80% do custo concentrado no output — então o preço de output pesa muito mais na conta final do que o preço de entrada anunciado com destaque.

E pra quem só usa por assinatura, sem API

Se sua empresa não desenvolve produto próprio e só usa a IA como ferramenta de trabalho, a conta é mais simples: ChatGPT Plus, Claude Pro e Google AI Pro giram todos perto de US$ 20 por mês — a diferença de custo-benefício entre eles está muito mais no que cada um integra ao seu fluxo de trabalho do que no preço em si.

Perguntas frequentes

Qual é a IA mais barata em 2026?

Entre os grandes laboratórios, o DeepSeek V4-Flash está entre os mais baratos, com cerca de US$ 0,14 por milhão de tokens de entrada. O GPT-5.6 Luna, da OpenAI, também compete nessa faixa de entrada.

As IAs chinesas ainda são mais baratas que as americanas?

Na maior parte dos casos, sim — mas a diferença encolheu. Depois do aumento de preço da DeepSeek em agosto de 2026 e dos cortes de preço da OpenAI, os dois lados competem lado a lado em várias faixas de preço, sem uma vantagem automática de origem.

Vale a pena usar sempre o modelo mais caro?

Raramente. A diferença de custo entre o modelo mais barato e o mais caro para a mesma tarefa pode passar de 50 vezes. A prática recomendada por quem opera em escala é rotear: modelo caro para tarefa complexa, modelo barato para tarefa repetitiva de alto volume.

Por que o preço de saída (output) é sempre maior que o de entrada?

Gerar texto exige mais processamento do que só interpretá-lo. Isso significa que aplicações com resposta longa — chatbot, geração de relatório — têm custo real dominado pelo preço de output, não pelo preço de input anunciado com mais destaque nas comparações.

Quer aprofundar em alguma das pontas? Já escrevemos sobre o cenário completo das IAs chinesas e sobre ChatGPT, Gemini ou Claude para uso pessoal.

Onde a Ketos entra

Escolher o modelo certo pra cada parte do seu produto ou processo é decisão técnica — e decisão de custo ao mesmo tempo.

A gente ajuda a desenhar essa estratégia: quais tarefas realmente precisam do modelo mais caro, onde um modelo mais barato entrega o mesmo resultado, e como montar essa arquitetura sem virar dor de cabeça de manutenção depois — inclusive avaliando quando um modelo chinês faz sentido, e o que isso exige em termos de dado e compliance.

Veja como funciona a automação com IA na Ketos ou conte seu desafio — respondemos em até 1 dia útil.


Preços verificados em 18 de agosto de 2026, com base em documentação oficial e agregadores de preço especializados. O mercado de IA muda preço com frequência muito alta — confirme o valor atual na página oficial de cada provedor antes de decidir.