Mga madalas itanong
Anong unit ang gamit sa presyo ng AI token?
USD bawat isang milyong token ang mga presyo. Magkakahiwalay ang rate ng input, output, at cached input. Mga presyo ito ng API, hindi bayad sa subscription ng ChatGPT, Claude, o Grok.
Paano kinukuwenta ang halaga ng API request?
I-multiply ang bilang ng bawat token sa katumbas na rate, idagdag ang mga halaga, at hatiin sa isang milyon. Pinapalitan ng cached input ang bahagi ng input count; hindi ito binibilang nang dalawang beses. Gumagamit ang calculator ng beripikadong rate at “hindi alam” ang ipinapakita kapag wala ang kailangang rate.
Nagbabago ba ang ayos ng talahanayan kapag nagpapalit ng modelo?
Sa comparison table sa home page, ang pagpili ng modelo ay nag-a-update lang sa row ng provider na iyon. I-click ang arrow sa input o output column para tahasang mag-sort. Hindi laging nangangahulugang mababa ang kabuuang halaga kapag mababa ang input price.
Maaari ko bang ipagpalagay na cached price ang singil sa bawat input token?
Hindi. Hindi garantiya ng cache hit ang nakalistang cached rate. Gamitin lang ang cached billing sa input na saklaw ng cache rules ng provider. Kailangan ng calculator na hindi lumampas ang cached input sa kabuuang input at hindi ito nagpapalagay ng discount kapag hindi alam ang rate.
Nagbabago ba ang presyo ng token para sa mahabang context?
May ilang pampublikong kondisyon ng presyo na nag-iiba ayon sa haba ng context o iba pang setting ng request. Tingnan ang context note at source ng napiling modelo. Ginagamit ng calculator ang naitalang long-context rate kung mayroon; hindi ito gumagawa-gawa ng nawawalang rate.
Palaging pinakamura sa kabuuan ang modelong may pinakamurang input?
Hindi. Nakadepende ang kabuuang halaga sa input, output, at naaangkop na cached tokens. Maaaring mas mahal ang modelong mura ang input pero mahal ang output para sa mahabang sagot. Ilagay sa calculator ang inaasahang bilang ng token at ihambing nang magkahiwalay ang mga rate.