Mga presyo ng token(USD/1M tokens)

USD / 1 milyong token
ModeloInputOutputNaka-cache na inputPinagmulan
gemini-3.8-flashGoogle $0.75$3.75$0.075Pinagmulan Okt 10
gemini-3.6-flashGoogle $0.75$3.75$0.075Pinagmulan Okt 10
gemini-3.5-flash-liteGoogle $0.30$2.50$0.03Pinagmulan Okt 10
gemini-3.1-flash-liteGoogle $0.25$1.50$0.025Pinagmulan Okt 10
gemini-3.1-pro-previewGoogle $2.00$12.00$0.20Pinagmulan Okt 10
gemini-3.1-pro-preview-customtoolsGoogle $2.00$12.00$0.20Pinagmulan Okt 10
gemini-3-flash-previewGoogle $0.50$3.00$0.05Pinagmulan Okt 10
gemini-2.5-proGoogle $1.25$10.00$0.125Pinagmulan Okt 10
gemini-2.5-flashGoogle $0.30$2.50$0.03Pinagmulan Okt 10
gemini-2.5-flash-liteGoogle $0.10$0.40$0.01Pinagmulan Okt 10
gemini-robotics-er-2-previewGoogle $1.00$5.00$0.10Pinagmulan Okt 10

Karaniwang singil sa API. Hindi kasama ang buwis, tool, at subscription.

Context

gemini-3.8-flash · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage. input: $0.75 hanggang Disyembre 31, 2026; $1.50 simula Enero 1, 2027. output: $3.75 hanggang Disyembre 31; $7.50 simula Enero 1. cachedInput: $0.075 hanggang Disyembre 31; $0.15 simula Enero 1.

gemini-3.6-flash · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage. input: $0.75 hanggang Disyembre 31, 2026; $1.50 simula Enero 1, 2027. output: $3.75 hanggang Disyembre 31; $7.50 simula Enero 1. cachedInput: $0.075 hanggang Disyembre 31; $0.15 simula Enero 1.

gemini-3.5-flash-lite · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage.

gemini-3.1-flash-lite · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage.

gemini-3.1-pro-preview · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage. Para sa prompt na ≤200,000 token ang base price; para sa >200,000 token ang long price.

gemini-3.1-pro-preview-customtools · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage. Para sa prompt na ≤200,000 token ang base price; para sa >200,000 token ang long price.

gemini-3-flash-preview · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage.

gemini-2.5-pro · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage. Para sa prompt na ≤200,000 token ang base price; para sa >200,000 token ang long price.

gemini-2.5-flash · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage.

gemini-2.5-flash-lite · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage.

gemini-robotics-er-2-preview · Standard paid text rate, USD bawat 1M token. Kasama sa output ang thinking token; hindi kasama ang audio rate, tools, at cache storage. input: text/image/video/audio $1.00 hanggang Disyembre 31, 2026; $2.00 simula Enero 1, 2027. output: $5.00 hanggang Disyembre 31; $10.00 simula Enero 1. cachedInput: $0.10 hanggang Disyembre 31; $0.20 simula Enero 1.

Tantiyahin ang gastos sa token

Tinatayang gastos—

Pagtatantiya lang ito para sa token, hindi aktuwal na singil ng task. Hindi kasama ang dagdag na tawag sa tool at mga retry.

Sulit sa gastos →

Mga madalas itanong

Higit pa
Anong unit ang gamit sa presyo ng AI token?

USD bawat isang milyong token ang mga presyo. Magkakahiwalay ang rate ng input, output, at cached input. Mga presyo ito ng API, hindi bayad sa subscription ng ChatGPT, Claude, o Grok.

Paano kinukuwenta ang halaga ng API request?

I-multiply ang bilang ng bawat token sa katumbas na rate, idagdag ang mga halaga, at hatiin sa isang milyon. Pinapalitan ng cached input ang bahagi ng input count; hindi ito binibilang nang dalawang beses. Gumagamit ang calculator ng beripikadong rate at “hindi alam” ang ipinapakita kapag wala ang kailangang rate.

Nagbabago ba ang ayos ng talahanayan kapag nagpapalit ng modelo?

Sa comparison table sa home page, ang pagpili ng modelo ay nag-a-update lang sa row ng provider na iyon. I-click ang arrow sa input o output column para tahasang mag-sort. Hindi laging nangangahulugang mababa ang kabuuang halaga kapag mababa ang input price.

Maaari ko bang ipagpalagay na cached price ang singil sa bawat input token?

Hindi. Hindi garantiya ng cache hit ang nakalistang cached rate. Gamitin lang ang cached billing sa input na saklaw ng cache rules ng provider. Kailangan ng calculator na hindi lumampas ang cached input sa kabuuang input at hindi ito nagpapalagay ng discount kapag hindi alam ang rate.

Nagbabago ba ang presyo ng token para sa mahabang context?

May ilang pampublikong kondisyon ng presyo na nag-iiba ayon sa haba ng context o iba pang setting ng request. Tingnan ang context note at source ng napiling modelo. Ginagamit ng calculator ang naitalang long-context rate kung mayroon; hindi ito gumagawa-gawa ng nawawalang rate.

Palaging pinakamura sa kabuuan ang modelong may pinakamurang input?

Hindi. Nakadepende ang kabuuang halaga sa input, output, at naaangkop na cached tokens. Maaaring mas mahal ang modelong mura ang input pero mahal ang output para sa mahabang sagot. Ilagay sa calculator ang inaasahang bilang ng token at ihambing nang magkahiwalay ang mga rate.