คำถามที่พบบ่อย
เปรียบเทียบประสิทธิภาพและต้นทุนโมเดล AI อย่างไร?
เปรียบเทียบคะแนน benchmark และต้นทุนงานที่วัดได้ภายในเวอร์ชันการประเมินเดียวกัน พร้อมตรวจการตั้งค่าการให้เหตุผลของแต่ละโมเดล ราคา input/output เพียงอย่างเดียวไม่ได้วัดประสิทธิภาพ ค่าที่ไม่มีการวัดยังคงไม่ทราบ
โมเดลที่ได้คะแนนสูงสุดดีที่สุดสำหรับฉันเสมอหรือไม่?
ไม่ คะแนน benchmark อธิบายการประเมินเฉพาะอย่าง งานของคุณ latency การตั้งค่าการให้เหตุผล และต้นทุนรวมอาจเปลี่ยนตัวเลือกได้ ดูทั้งคอลัมน์คะแนนและต้นทุน และเปิดแหล่ง benchmark เพื่อดูเงื่อนไข
คะแนน benchmark ที่ไม่ทราบหมายถึงโมเดลทำงานแย่ไหม?
ไม่ หมายถึงไม่มีผลการวัดที่ตรวจสอบแล้วและเปรียบเทียบได้ในแค็ตตาล็อกนี้ เราไม่กำหนดเป็นศูนย์หรือประมาณคะแนนจากชื่อโมเดลหรือราคา token ค่าที่ขาดแยกจากผลที่วัดได้