ราคาโทเค็น(USD/1M tokens)

USD / 1 ล้านโทเค็น
โมเดลอินพุตเอาต์พุตอินพุตแคชแหล่งข้อมูล
gemini-3.8-flashGoogle US$0.75US$3.75US$0.075แหล่งข้อมูล 10 ต.ค.
gemini-3.6-flashGoogle US$0.75US$3.75US$0.075แหล่งข้อมูล 10 ต.ค.
gemini-3.5-flash-liteGoogle US$0.30US$2.50US$0.03แหล่งข้อมูล 10 ต.ค.
gemini-3.1-flash-liteGoogle US$0.25US$1.50US$0.025แหล่งข้อมูล 10 ต.ค.
gemini-3.1-pro-previewGoogle US$2.00US$12.00US$0.20แหล่งข้อมูล 10 ต.ค.
gemini-3.1-pro-preview-customtoolsGoogle US$2.00US$12.00US$0.20แหล่งข้อมูล 10 ต.ค.
gemini-3-flash-previewGoogle US$0.50US$3.00US$0.05แหล่งข้อมูล 10 ต.ค.
gemini-2.5-proGoogle US$1.25US$10.00US$0.125แหล่งข้อมูล 10 ต.ค.
gemini-2.5-flashGoogle US$0.30US$2.50US$0.03แหล่งข้อมูล 10 ต.ค.
gemini-2.5-flash-liteGoogle US$0.10US$0.40US$0.01แหล่งข้อมูล 10 ต.ค.
gemini-robotics-er-2-previewGoogle US$1.00US$5.00US$0.10แหล่งข้อมูล 10 ต.ค.

อัตรา API มาตรฐาน ไม่รวมภาษี เครื่องมือ และการสมัครสมาชิก

บริบท

gemini-3.8-flash · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache input: $0.75 ถึง 31 ธ.ค. 2026; $1.50 ตั้งแต่ 1 ม.ค. 2027 output: $3.75 ถึงสิ้นปี 2026; $7.50 ตั้งแต่ปี 2027 cachedInput: $0.075 เป็น $0.15 ตามวันดังกล่าว

gemini-3.6-flash · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache input: $0.75 ถึง 31 ธ.ค. 2026; $1.50 ตั้งแต่ 1 ม.ค. 2027 output: $3.75 ถึงสิ้นปี 2026; $7.50 ตั้งแต่ปี 2027 cachedInput: $0.075 เป็น $0.15 ตามวันดังกล่าว

gemini-3.5-flash-lite · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache

gemini-3.1-flash-lite · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache

gemini-3.1-pro-preview · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache ราคา base ใช้กับ prompt ≤200,000 tokens; ราคา context ยาวใช้กับ prompt >200,000 tokens

gemini-3.1-pro-preview-customtools · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache ราคา base ใช้กับ prompt ≤200,000 tokens; ราคา context ยาวใช้กับ prompt >200,000 tokens

gemini-3-flash-preview · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache

gemini-2.5-pro · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache ราคา base ใช้กับ prompt ≤200,000 tokens; ราคา context ยาวใช้กับ prompt >200,000 tokens

gemini-2.5-flash · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache

gemini-2.5-flash-lite · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache

gemini-robotics-er-2-preview · อัตราข้อความแบบชำระเงินมาตรฐาน USD ต่อ 1M tokens Output รวม thinking tokens; ไม่รวมอัตราเสียง เครื่องมือ และที่เก็บ cache input: text/image/video/audio $1.00 ถึง 31 ธ.ค. 2026 และ $2.00 ตั้งแต่ 1 ม.ค. 2027 output: $5.00 ถึงสิ้นปี 2026 และ $10.00 ตั้งแต่ปี 2027 cachedInput: $0.10 เป็น $0.20

ประมาณค่าใช้จ่ายโทเค็น

ค่าใช้จ่ายโดยประมาณ—

เป็นการประเมินค่าโทเค็นเท่านั้น ไม่ใช่ใบเรียกเก็บเงินของงานจริง ไม่รวมการเรียกใช้เครื่องมือเพิ่มเติมและการลองใหม่

ความคุ้มค่า →

คำถามที่พบบ่อย

เพิ่มเติม
ราคาโทเค็น AI คิดเป็นหน่วยใด?

ราคาเป็นดอลลาร์สหรัฐต่อหนึ่งล้าน tokens อัตรา input, output และ cached input แยกกัน นี่คือราคา API ไม่ใช่ค่าสมาชิก ChatGPT, Claude หรือ Grok

คำนวณค่าใช้จ่ายคำขอ API อย่างไร?

คูณจำนวน token แต่ละประเภทด้วยอัตราที่ตรงกัน รวมยอดแล้วหารด้วยหนึ่งล้าน cached input ใช้แทนบางส่วนของ input จึงไม่นับซ้ำ เครื่องคำนวณใช้อัตราที่ตรวจสอบแล้วและแสดงว่าไม่ทราบเมื่อไม่มีอัตราที่จำเป็น

เปลี่ยนโมเดลแล้วลำดับตารางเปลี่ยนไหม?

ในตารางเปรียบเทียบหน้าแรก การเลือกโมเดลจะอัปเดตเฉพาะแถวของผู้ให้บริการนั้น คลิกลูกศรคอลัมน์ input หรือ output เพื่อจัดเรียงโดยตรง ราคา input ต่ำไม่ได้หมายความว่าต้นทุนรวมต่ำเสมอ

ถือว่า token input ทุกตัวคิดในราคา cache ได้ไหม?

ไม่ได้ อัตรา cache ที่แสดงไม่ได้รับประกันว่า cache hit ใช้ราคา cache เฉพาะ input ที่อยู่ภายใต้กฎ cache ของผู้ให้บริการ เครื่องคำนวณกำหนดให้ cached input ไม่เกิน input รวม และไม่สมมติส่วนลดเมื่อไม่ทราบอัตรา

ราคา token เปลี่ยนตาม context ที่ยาวขึ้นได้ไหม?

เงื่อนไขราคาสาธารณะบางรายการแยกตามความยาว context หรือการตั้งค่าคำขออื่น ดูหมายเหตุ context และแหล่งข้อมูลของโมเดลที่เลือก เครื่องคำนวณใช้อัตรา context ยาวที่บันทึกไว้เมื่อมี และไม่สร้างอัตราที่ขาดหายขึ้นเอง

โมเดลที่ราคา input ถูกที่สุดถูกที่สุดโดยรวมเสมอไหม?

ไม่ ต้นทุนรวมขึ้นอยู่กับ input, output และ cached tokens ที่เกี่ยวข้อง โมเดลที่ input ถูกแต่ output แพงอาจมีค่าใช้จ่ายสูงกว่าสำหรับคำตอบยาว ใส่จำนวน token ที่คาดไว้ในเครื่องคำนวณและเปรียบเทียบอัตราแยกกัน