Vista 7 · operación
Coste y latencia
Lo que cuesta y lo que tarda cada configuración por mensaje, frente a lo que acierta. El coste es solo el de API; los modelos abiertos cuestan 0 en API pero necesitan una GPU propia (aquí, un DGX Spark), cuyo coste no se incluye.
Una pasada
Con revisor
Color: familia del modelo de la 1ª pasada. Etiquetadas: las configuraciones que ninguna otra supera a la vez en calidad y latencia (si no cabe la etiqueta, el detalle está al pasar el ratón).
Tabla completa
Latencia: mediana por mensaje. En las configuraciones con revisor es la suma de las dos pasadas. Jev se mide por API desde Europa; los modelos abiertos, en una GPU GB10 con el modelo ya cargado. Coste de Jev: el que devuelve OpenRouter, o los tokens de entrada × $0.042/M en la API de TypeSafe.
system-one-bench