Harga token(USD/1 juta token)

USD / 1 juta token
ModelInputOutputInput dicacheSumber
deepseek-flashDeepSeek USD 0.30USD 1.20USD 0.006Sumber 10 Okt
deepseek-v4-proDeepSeek USD 1.32USD 3.96USD 0.044Sumber 10 Okt

Kadar API standard. Cukai, alat dan langganan tidak termasuk.

Konteks

deepseek-flash · Kadar waktu puncak. Kadar luar puncak ialah separuh daripada ini; lihat waktu UTC rasmi.

deepseek-v4-pro · Kadar waktu puncak. Kadar luar puncak ialah separuh daripada ini; lihat waktu UTC rasmi.

Anggarkan kos token

Anggaran kos—

Anggaran token sahaja, bukan bil tugas sebenar. Panggilan alat tambahan dan percubaan semula tidak termasuk.

Nilai untuk wang →

Soalan lazim

Lagi
Apakah unit harga token AI?

Harga ialah dolar AS bagi setiap sejuta token. Kadar input, output dan input cache berasingan. Ini harga API, bukannya yuran langganan ChatGPT, Claude atau Grok.

Bagaimanakah kos permintaan API dikira?

Darabkan bilangan setiap token dengan kadar yang sepadan, jumlahkan amaun, kemudian bahagikan dengan satu juta. Input cache menggantikan sebahagian input; ia tidak dikira dua kali. Kalkulator menggunakan kadar yang disahkan dan memaparkan tidak diketahui jika kadar yang diperlukan tiada.

Adakah menukar model mengubah susunan jadual?

Dalam jadual perbandingan halaman utama, memilih model hanya mengemas kini baris penyedia tersebut. Klik anak panah lajur input atau output untuk mengisih secara jelas. Harga input rendah tidak semestinya bermaksud kos keseluruhan rendah.

Bolehkah saya menganggap setiap token input dibilkan pada harga cache?

Tidak. Kadar cache yang disenaraikan tidak menjamin cache hit. Gunakan bil cache hanya untuk input yang diliputi peraturan cache penyedia. Kalkulator mensyaratkan input cache tidak melebihi jumlah input dan tidak mengandaikan diskaun apabila kadarnya tidak diketahui.

Bolehkah harga token berubah untuk konteks panjang?

Sesetengah syarat harga yang diterbitkan membezakan panjang konteks atau tetapan permintaan lain. Semak nota konteks dan sumber bagi model pilihan. Kalkulator menggunakan kadar konteks panjang yang direkodkan jika tersedia; kadar yang tiada tidak direka-reka.

Adakah model dengan input termurah sentiasa paling murah keseluruhannya?

Tidak. Kos keseluruhan bergantung pada input, output dan token cache yang berkenaan. Model dengan input murah tetapi output mahal boleh menelan belanja lebih untuk jawapan panjang. Masukkan anggaran token anda dalam kalkulator dan bandingkan kadar secara berasingan.