Perguntas frequentes
Em que unidade são informados os preços de tokens de IA?
Os preços são em dólares americanos por 1 milhão de tokens. Entrada, saída e entrada em cache têm tarifas separadas. São preços de API, não valores de assinatura do ChatGPT, Claude ou Grok.
Como é calculado o custo de uma solicitação à API?
Multiplique cada quantidade de tokens pela tarifa correspondente, some os valores e divida por 1 milhão. A entrada em cache substitui parte da entrada; ela não é contada duas vezes. A calculadora usa tarifas verificadas e mostra “desconhecido” quando uma tarifa necessária não está disponível.
Trocar de modelo muda a ordem da tabela?
Na tabela comparativa da página inicial, escolher um modelo atualiza somente a linha daquele provedor. Clique na seta da coluna de entrada ou saída para ordenar explicitamente. Um preço baixo de entrada não significa necessariamente um custo total baixo.
Posso presumir que todos os tokens de entrada são cobrados pela tarifa de cache?
Não. Uma tarifa de cache publicada não garante que haverá um acerto de cache. Use a cobrança em cache somente para a entrada coberta pelas regras de cache do provedor. A calculadora exige que a entrada em cache não ultrapasse a entrada total e não presume desconto quando a tarifa é desconhecida.
O preço do token pode mudar com um contexto longo?
Algumas condições de preço publicadas diferenciam tamanhos de contexto ou outras configurações da solicitação. Confira as observações de contexto e a fonte do modelo selecionado. Quando disponível, a calculadora usa a tarifa registrada para contexto longo; ela não inventa tarifas ausentes.
O modelo com a entrada mais barata é sempre o mais barato no total?
Não. O custo total depende da entrada, da saída e dos tokens em cache aplicáveis. Um modelo com entrada barata e saída cara pode custar mais para uma resposta longa. Informe as quantidades de tokens esperadas na calculadora e compare as tarifas separadamente.