Preços de tokens(USD por 1 milhão de tokens)

USD / 1 milhão de tokens
ModeloEntradaSaídaEntrada em cacheFonte
gpt-6-astraOpenAI US$ 10,00US$ 50,00US$ 1,00Fonte 10 de out.
gpt-6.1-solOpenAI US$ 2,00US$ 10,00US$ 0,10Fonte 10 de out.
gpt-6-lunaOpenAI US$ 0,10US$ 0,50US$ 0,01Fonte 10 de out.
gpt-5.6-solOpenAI US$ 4,00US$ 20,00US$ 0,40Fonte 10 de out.
Claude Fable 5.1Anthropic US$ 10,00US$ 50,00US$ 0,25Fonte 10 de out.
Claude Opus 5.5Anthropic US$ 4,00US$ 20,00US$ 0,20Fonte 10 de out.
Claude Sonnet 5.5Anthropic US$ 2,00US$ 10,00US$ 0,10Fonte 10 de out.
Claude Haiku 5.5Anthropic US$ 0,10US$ 0,50US$ 0,01Fonte 10 de out.
Claude Mythos 5.1Anthropic US$ 10,00US$ 50,00US$ 0,25Fonte 10 de out.
Claude Fable 5Anthropic US$ 10,00US$ 50,00US$ 1,00Fonte 10 de out.
Claude Mythos 5Anthropic US$ 10,00US$ 50,00US$ 1,00Fonte 10 de out.
Claude Opus 5Anthropic US$ 5,00US$ 25,00US$ 0,50Fonte 10 de out.
Claude Opus 4.8Anthropic US$ 5,00US$ 25,00US$ 0,50Fonte 10 de out.
Claude Opus 4.7Anthropic US$ 5,00US$ 25,00US$ 0,50Fonte 10 de out.
Claude Opus 4.6Anthropic US$ 5,00US$ 25,00US$ 0,50Fonte 10 de out.
Claude Opus 4.5Anthropic US$ 5,00US$ 25,00US$ 0,50Fonte 10 de out.
Claude Opus 4.1Anthropic US$ 15,00US$ 75,00US$ 1,50Fonte 10 de out.
Claude Opus 4Anthropic US$ 15,00US$ 75,00US$ 1,50Fonte 10 de out.
Claude Sonnet 5Anthropic US$ 2,00US$ 10,00US$ 0,20Fonte 10 de out.
Claude Sonnet 4.6Anthropic US$ 3,00US$ 15,00US$ 0,30Fonte 10 de out.
Claude Sonnet 4.5Anthropic US$ 3,00US$ 15,00US$ 0,30Fonte 10 de out.
Claude Sonnet 4Anthropic US$ 3,00US$ 15,00US$ 0,30Fonte 10 de out.
Claude Haiku 4.5Anthropic US$ 1,00US$ 5,00US$ 0,10Fonte 10 de out.
Claude Haiku 3.5Anthropic US$ 0,80US$ 4,00US$ 0,08Fonte 10 de out.
grok-4.7xAI US$ 2,00US$ 6,00US$ 0,50Fonte 10 de out.
grok-build-0.1xAI US$ 1,00US$ 2,00US$ 0,20Fonte 10 de out.
grok-4.6xAI US$ 2,00US$ 6,00US$ 0,50Fonte 10 de out.
grok-4.5xAI US$ 2,00US$ 6,00US$ 0,30Fonte 10 de out.
grok-4.3xAI US$ 1,25US$ 2,50US$ 0,20Fonte 10 de out.
grok-4.20-multi-agent-0309xAI US$ 1,25US$ 2,50US$ 0,20Fonte 10 de out.
grok-4.20-0309-reasoningxAI US$ 1,25US$ 2,50US$ 0,20Fonte 10 de out.
grok-4.20-0309-non-reasoningxAI US$ 1,25US$ 2,50US$ 0,20Fonte 10 de out.
gemini-3.8-flashGoogle US$ 0,75US$ 3,75US$ 0,075Fonte 10 de out.
gemini-3.6-flashGoogle US$ 0,75US$ 3,75US$ 0,075Fonte 10 de out.
gemini-3.5-flash-liteGoogle US$ 0,30US$ 2,50US$ 0,03Fonte 10 de out.
gemini-3.1-flash-liteGoogle US$ 0,25US$ 1,50US$ 0,025Fonte 10 de out.
gemini-3.1-pro-previewGoogle US$ 2,00US$ 12,00US$ 0,20Fonte 10 de out.
gemini-3.1-pro-preview-customtoolsGoogle US$ 2,00US$ 12,00US$ 0,20Fonte 10 de out.
gemini-3-flash-previewGoogle US$ 0,50US$ 3,00US$ 0,05Fonte 10 de out.
gemini-2.5-proGoogle US$ 1,25US$ 10,00US$ 0,125Fonte 10 de out.
gemini-2.5-flashGoogle US$ 0,30US$ 2,50US$ 0,03Fonte 10 de out.
gemini-2.5-flash-liteGoogle US$ 0,10US$ 0,40US$ 0,01Fonte 10 de out.
gemini-robotics-er-2-previewGoogle US$ 1,00US$ 5,00US$ 0,10Fonte 10 de out.
deepseek-flashDeepSeek US$ 0,30US$ 1,20US$ 0,006Fonte 10 de out.
deepseek-v4-proDeepSeek US$ 1,32US$ 3,96US$ 0,044Fonte 10 de out.
kimi-k3Kimi US$ 3,00US$ 15,00US$ 0,30Fonte 10 de out.
kimi-k2.7-codeKimi US$ 0,95US$ 4,00US$ 0,19Fonte 10 de out.
kimi-k2.7-code-highspeedKimi US$ 1,90US$ 8,00US$ 0,38Fonte 10 de out.
kimi-k2.6Kimi US$ 0,95US$ 4,00US$ 0,16Fonte 10 de out.

Tarifas padrão de API. Impostos, ferramentas e assinaturas não incluídos.

Contexto

gpt-6-astra · Contexto curto, nível padrão; consulte a fonte para ver os limites.

gpt-6.1-sol · Contexto curto, nível padrão; consulte a fonte para ver os limites.

gpt-6-luna · Contexto curto, nível padrão; consulte a fonte para ver os limites.

gpt-5.6-sol · Contexto curto, nível padrão; consulte a fonte para ver os limites.

Claude Fable 5.1 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Opus 5.5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Sonnet 5.5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Haiku 5.5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Mythos 5.1 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Fable 5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Mythos 5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Opus 5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Opus 4.8 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Opus 4.7 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Opus 4.6 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Opus 4.5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Opus 4.1 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Opus 4 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Sonnet 5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Sonnet 4.6 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Sonnet 4.5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Sonnet 4 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Haiku 4.5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

Claude Haiku 3.5 · Tarifa básica da API; linhas com preço dependente do contexto foram excluídas.

grok-4.7 · Endpoint global, para prompts com menos de 200 mil tokens.

grok-build-0.1 · Endpoint global, para prompts com menos de 200 mil tokens.

grok-4.6 · Endpoint global, para prompts com menos de 200 mil tokens.

grok-4.5 · Endpoint global, para prompts com menos de 200 mil tokens.

grok-4.3 · Endpoint global, para prompts com menos de 200 mil tokens.

grok-4.20-multi-agent-0309 · Endpoint global, para prompts com menos de 200 mil tokens.

grok-4.20-0309-reasoning · Endpoint global, para prompts com menos de 200 mil tokens.

grok-4.20-0309-non-reasoning · Endpoint global, para prompts com menos de 200 mil tokens.

gemini-3.8-flash · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos. Entrada: US$ 0,75 até 31 de dezembro de 2026; US$ 1,50 a partir de 1º de janeiro de 2027. Saída: US$ 3,75 até 31 de dezembro de 2026; US$ 7,50 a partir de 1º de janeiro de 2027. Entrada em cache: US$ 0,075 até 31 de dezembro de 2026; US$ 0,15 a partir de 1º de janeiro de 2027.

gemini-3.6-flash · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos. Entrada: US$ 0,75 até 31 de dezembro de 2026; US$ 1,50 a partir de 1º de janeiro de 2027. Saída: US$ 3,75 até 31 de dezembro de 2026; US$ 7,50 a partir de 1º de janeiro de 2027. Entrada em cache: US$ 0,075 até 31 de dezembro de 2026; US$ 0,15 a partir de 1º de janeiro de 2027.

gemini-3.5-flash-lite · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos.

gemini-3.1-flash-lite · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos.

gemini-3.1-pro-preview · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos. Os preços básicos valem para prompts de até 200 mil tokens; os preços de contexto longo valem para prompts com mais de 200 mil tokens.

gemini-3.1-pro-preview-customtools · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos. Os preços básicos valem para prompts de até 200 mil tokens; os preços de contexto longo valem para prompts com mais de 200 mil tokens.

gemini-3-flash-preview · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos.

gemini-2.5-pro · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos. Os preços básicos valem para prompts de até 200 mil tokens; os preços de contexto longo valem para prompts com mais de 200 mil tokens.

gemini-2.5-flash · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos.

gemini-2.5-flash-lite · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos.

gemini-robotics-er-2-preview · Tarifas padrão de texto pago, em USD por 1 milhão de tokens. A saída inclui tokens de raciocínio; tarifas de áudio, ferramentas e armazenamento em cache são excluídos. Entrada: US$ 1,00 (texto/imagem/vídeo/áudio) até 31 de dezembro de 2026; US$ 2,00 a partir de 1º de janeiro de 2027. Saída: US$ 5,00 até 31 de dezembro de 2026; US$ 10,00 a partir de 1º de janeiro de 2027. Entrada em cache: US$ 0,10 até 31 de dezembro de 2026; US$ 0,20 a partir de 1º de janeiro de 2027.

deepseek-flash · Tarifa de horário de pico. Fora do pico, ela cai pela metade; consulte o horário oficial em UTC.

deepseek-v4-pro · Tarifa de horário de pico. Fora do pico, ela cai pela metade; consulte o horário oficial em UTC.

kimi-k3 · Preço padrão da API, sem impostos, gravações em cache nem ferramentas.

kimi-k2.7-code · Preço padrão da API, sem impostos, gravações em cache nem ferramentas.

kimi-k2.7-code-highspeed · Preço padrão da API, sem impostos, gravações em cache nem ferramentas.

kimi-k2.6 · Preço padrão da API, sem impostos, gravações em cache nem ferramentas.

Estimar custo de tokens

Custo estimado—

Estimativa somente de tokens, não é o custo real de uma tarefa. Chamadas extras a ferramentas e novas tentativas não estão incluídas.

Custo-benefício →

Perguntas frequentes

Mais
Em que unidade são informados os preços de tokens de IA?

Os preços são em dólares americanos por 1 milhão de tokens. Entrada, saída e entrada em cache têm tarifas separadas. São preços de API, não valores de assinatura do ChatGPT, Claude ou Grok.

Como é calculado o custo de uma solicitação à API?

Multiplique cada quantidade de tokens pela tarifa correspondente, some os valores e divida por 1 milhão. A entrada em cache substitui parte da entrada; ela não é contada duas vezes. A calculadora usa tarifas verificadas e mostra “desconhecido” quando uma tarifa necessária não está disponível.

Trocar de modelo muda a ordem da tabela?

Na tabela comparativa da página inicial, escolher um modelo atualiza somente a linha daquele provedor. Clique na seta da coluna de entrada ou saída para ordenar explicitamente. Um preço baixo de entrada não significa necessariamente um custo total baixo.

Posso presumir que todos os tokens de entrada são cobrados pela tarifa de cache?

Não. Uma tarifa de cache publicada não garante que haverá um acerto de cache. Use a cobrança em cache somente para a entrada coberta pelas regras de cache do provedor. A calculadora exige que a entrada em cache não ultrapasse a entrada total e não presume desconto quando a tarifa é desconhecida.

O preço do token pode mudar com um contexto longo?

Algumas condições de preço publicadas diferenciam tamanhos de contexto ou outras configurações da solicitação. Confira as observações de contexto e a fonte do modelo selecionado. Quando disponível, a calculadora usa a tarifa registrada para contexto longo; ela não inventa tarifas ausentes.

O modelo com a entrada mais barata é sempre o mais barato no total?

Não. O custo total depende da entrada, da saída e dos tokens em cache aplicáveis. Um modelo com entrada barata e saída cara pode custar mais para uma resposta longa. Informe as quantidades de tokens esperadas na calculadora e compare as tarifas separadamente.