Vanliga frågor
Hur jämför man prestanda och kostnader för AI-modeller?
Jämför benchmarkpoäng och uppmätta uppgiftskostnader inom samma utvärderingsversion och kontrollera varje modells inställningar för resonemang. Priser för in- och utdata mäter inte prestanda i sig. Saknade mätningar lämnas som okända.
Är modellen med högst poäng alltid bäst för mig?
Nej. Benchmarkpoäng beskriver en viss utvärdering. Din uppgift, svarstid, inställningar för resonemang och totalkostnad kan påverka valet. Använd poäng- och kostnadskolumnerna tillsammans och öppna benchmarkkällan för att se villkoren.
Betyder en okänd benchmarkpoäng att modellen presterar dåligt?
Nej. Det betyder att katalogen saknar en jämförbar verifierad mätning. Vi sätter inte poängen till noll eller uppskattar den utifrån modellnamn eller tokenpris. Saknade värden hålls åtskilda från uppmätta resultat.