system-one-bench v0.5.0
Vista 7 · operación

Coste y latencia

Lo que cuesta y lo que tarda cada configuración por mensaje, frente a lo que acierta. El coste es solo el de API; los modelos abiertos cuestan 0 en API pero necesitan una GPU propia (aquí, un DGX Spark), cuyo coste no se incluye.

Una pasada Con revisor Color: familia del modelo de la 1ª pasada. Etiquetadas: las configuraciones que ninguna otra supera a la vez en calidad y latencia (si no cabe la etiqueta, el detalle está al pasar el ratón).

Tabla completa

Latencia: mediana por mensaje. En las configuraciones con revisor es la suma de las dos pasadas. Jev se mide por API desde Europa; los modelos abiertos, en una GPU GB10 con el modelo ya cargado. Coste de Jev: el que devuelve OpenRouter, o los tokens de entrada × $0.042/M en la API de TypeSafe.