Mga presyo ng token(USD/1M tokens)

USD / 1 milyong token
ModeloInputOutputNaka-cache na inputPinagmulan
kimi-k3Kimi $3.00$15.00$0.30Pinagmulan Okt 10
kimi-k2.7-codeKimi $0.95$4.00$0.19Pinagmulan Okt 10
kimi-k2.7-code-highspeedKimi $1.90$8.00$0.38Pinagmulan Okt 10
kimi-k2.6Kimi $0.95$4.00$0.16Pinagmulan Okt 10

Karaniwang singil sa API. Hindi kasama ang buwis, tool, at subscription.

Context

kimi-k3 · Standard API price na hindi kasama ang tax, cache writes, at tools.

kimi-k2.7-code · Standard API price na hindi kasama ang tax, cache writes, at tools.

kimi-k2.7-code-highspeed · Standard API price na hindi kasama ang tax, cache writes, at tools.

kimi-k2.6 · Standard API price na hindi kasama ang tax, cache writes, at tools.

Tantiyahin ang gastos sa token

Tinatayang gastos—

Pagtatantiya lang ito para sa token, hindi aktuwal na singil ng task. Hindi kasama ang dagdag na tawag sa tool at mga retry.

Sulit sa gastos →

Mga madalas itanong

Higit pa
Anong unit ang gamit sa presyo ng AI token?

USD bawat isang milyong token ang mga presyo. Magkakahiwalay ang rate ng input, output, at cached input. Mga presyo ito ng API, hindi bayad sa subscription ng ChatGPT, Claude, o Grok.

Paano kinukuwenta ang halaga ng API request?

I-multiply ang bilang ng bawat token sa katumbas na rate, idagdag ang mga halaga, at hatiin sa isang milyon. Pinapalitan ng cached input ang bahagi ng input count; hindi ito binibilang nang dalawang beses. Gumagamit ang calculator ng beripikadong rate at “hindi alam” ang ipinapakita kapag wala ang kailangang rate.

Nagbabago ba ang ayos ng talahanayan kapag nagpapalit ng modelo?

Sa comparison table sa home page, ang pagpili ng modelo ay nag-a-update lang sa row ng provider na iyon. I-click ang arrow sa input o output column para tahasang mag-sort. Hindi laging nangangahulugang mababa ang kabuuang halaga kapag mababa ang input price.

Maaari ko bang ipagpalagay na cached price ang singil sa bawat input token?

Hindi. Hindi garantiya ng cache hit ang nakalistang cached rate. Gamitin lang ang cached billing sa input na saklaw ng cache rules ng provider. Kailangan ng calculator na hindi lumampas ang cached input sa kabuuang input at hindi ito nagpapalagay ng discount kapag hindi alam ang rate.

Nagbabago ba ang presyo ng token para sa mahabang context?

May ilang pampublikong kondisyon ng presyo na nag-iiba ayon sa haba ng context o iba pang setting ng request. Tingnan ang context note at source ng napiling modelo. Ginagamit ng calculator ang naitalang long-context rate kung mayroon; hindi ito gumagawa-gawa ng nawawalang rate.

Palaging pinakamura sa kabuuan ang modelong may pinakamurang input?

Hindi. Nakadepende ang kabuuang halaga sa input, output, at naaangkop na cached tokens. Maaaring mas mahal ang modelong mura ang input pero mahal ang output para sa mahabang sagot. Ilagay sa calculator ang inaasahang bilang ng token at ihambing nang magkahiwalay ang mga rate.