... Más ->¿Cómo se pueden comparar el rendimiento y el coste de los modelos de IA?
Compara las puntuaciones de referencia y los costes medidos de las tareas dentro de la misma versión de evaluación y comprueba la configuración de razonamiento de cada modelo. Los precios de entrada y salida por sí solos no miden el rendimiento. Las mediciones que faltan se dejan como desconocidas.
¿El modelo con la puntuación más alta es siempre el mejor para mí?
No. Las puntuaciones de referencia describen una evaluación concreta. La tarea, la latencia, la configuración de razonamiento y el coste total pueden cambiar cuál te conviene. Consulta conjuntamente las columnas de puntuación y coste, y abre la fuente de la evaluación para ver sus condiciones.
¿Una puntuación de referencia desconocida significa que el modelo rinde mal?
No. Significa que este catálogo no dispone de una medición verificada comparable. No asignamos un cero ni estimamos la puntuación a partir del nombre del modelo o del precio de los tokens. Los valores que faltan se mantienen separados de los resultados medidos.