Preços das APIs de IA

Preço por token não é preço por texto

O mesmo texto em português vira 59 tokens no GPT-5 e 111 no Claude Opus 5. A diferença de preço entre os dois é de 4 vezes, mas a de custo é de 7,5.

Há inversões. O Claude Sonnet 5 custa US$ 2,00 por milhão contra US$ 2,50 do GPT-5.4 e sai 50% mais caro na prática, por consumir quase o dobro de tokens.

A coluna Custo real compara o mesmo texto em todos os modelos: o exemplo da calculadora, 292 caracteres, em 10.000 execuções.

Método: a contagem de tokens é medida uma vez no tokenizador oficial de cada modelo e multiplicada pelo preço do provedor. Nenhuma chamada foi executada 10 mil vezes. Considera só input, sem cache. Medição de 25/09/2026.

42 modelos
Preços de input, cache e output por 1 milhão de tokens, com o custo real do texto de exemplo em cada modelo
USD / 1M tokensUSD / 1M tokensUSD / 1M tokensmesmo texto, 10 mil execuções
GPT-6 AstraChatGPT$10$1$50$5.9059 tokens
GPT-5.6 SolChatGPT$4$0.4$20$2.3659 tokens
GPT-5.6 TerraChatGPT$2$0.2$12$1.1859 tokens
GPT-5.6 LunaChatGPT$0.2$0.02$1.2$0.11859 tokens
GPT-5.5ChatGPT$5$0.5$30$2.9559 tokens
GPT-5.5 ProChatGPT$30não tem$180$17.7059 tokens
GPT-5.4ChatGPT$2.5$0.25$15$1.4859 tokens
GPT-5.4 miniChatGPT$0.75$0.075$4.5$0.44359 tokens
GPT-5.4 nanoChatGPT$0.2$0.02$1.25$0.11859 tokens
GPT-5.4 ProChatGPT$30não tem$180$17.7059 tokens
GPT-5.2ChatGPT$1.75$0.175$14$1.0359 tokens
GPT-5.2 ProChatGPT$21não tem$168$12.3959 tokens
GPT-5.1ChatGPT$1.25$0.125$10$0.73859 tokens
GPT-5ChatGPT$1.25$0.125$10$0.73859 tokens
GPT-5 miniChatGPT$0.25$0.025$2$0.14759 tokens
GPT-5 nanoChatGPT$0.05$0.005$0.4$0.03059 tokens
GPT-5 ProChatGPT$15não tem$120$8.8559 tokens
GPT-4.1ChatGPT$2$0.5$8$1.1859 tokens
GPT-4.1 miniChatGPT$0.4$0.1$1.6$0.23659 tokens
GPT-4.1 nanoChatGPT$0.1$0.025$0.4$0.05959 tokens
GPT-4oChatGPT$2.5$1.25$10$1.4859 tokens
GPT-4o miniChatGPT$0.15$0.075$0.6$0.08859 tokens
o3ChatGPT$2$0.5$8$1.1859 tokens
o4-miniChatGPT$1.1$0.275$4.4$0.64959 tokens
Opus 5.5Claude$4$0.2$20$4.52113 tokens
Opus 5Claude$5$0.5$25$5.55111 tokens
Sonnet 5Claude$2$0.2$10$2.22111 tokens
Haiku 4.5Claude$1$0.1$5$0.87087 tokens
Fable 5.1Claude$10$0.25$50$11.30113 tokens
Fable 5Claude$10$1$50$11.10111 tokens
Opus 4.8Claude$5$0.5$25$5.55111 tokens
Opus 4.7Claude$5$0.5$25$5.80116 tokens
Opus 4.6Claude$5$0.5$25$4.3587 tokens
Sonnet 4.6Claude$3$0.3$15$2.6187 tokens
Sonnet 4.5Claude$3$0.3$15$2.6187 tokens
3.8 FlashGemini$0.75$0.075$3.75$0.45861 tokens
3.7 FlashGemini$0.75$0.075$3.75$0.45861 tokens
3.6 FlashGemini$0.75$0.075$3.75$0.45861 tokens
3.5 FlashGemini$1.5$0.15$9$0.91561 tokens
3.5 Flash-LiteGemini$0.3$0.03$2.5$0.18361 tokens
3.1 Pro (preview)Gemini$2$0.2$12$1.2261 tokens
3.1 Flash-LiteGemini$0.25$0.025$1.5$0.15261 tokens

Selecione de 2 a 4 modelos para comparar.

A coluna Cache

Cache de prompt é o desconto aplicado a trechos repetidos. Instruções de sistema e histórico de conversa se repetem a cada chamada, e o provedor cobra menos para reprocessá-los: 10% do preço de input na Anthropic, 10% a 25% na OpenAI.

“Não tem” significa que o provedor não oferece o desconto naquele modelo, e não que o cache seja gratuito. É o caso dos modelos Pro da OpenAI, onde input repetido é cobrado pelo preço cheio.

A coluna mostra apenas a leitura do cache. A gravação é cobrada à parte e custa acima do input normal, o que torna o cache vantajoso a partir da segunda reutilização. No Google há ainda cobrança por hora de armazenagem.

Valores em USD por 1M de tokens · Tier padrão, sem batch ou desconto de volume · Fonte: páginas oficiais dos provedores · Revisão: 25/09/2026