Análisis de velocidad
Latencia medida en todas las ejecuciones de benchmark. P50 (mediana) y P95 (percentil 95) dan una imagen realista de la velocidad de respuesta bajo carga normal y máxima.
Tokens por segundo
Rendimiento en tokens por segundo, derivado de la latencia P50 medida. Más alto es mejor; las fluctuaciones reflejan la carga del lado del proveedor.
Estimado a partir de latencia P50 × 200 tokens de salida — el número absoluto depende de esta suposición; lo que importa es la tendencia.
Capacidades
Disponibilidad
Disponibilidad
Sin datos todavía
Aún no hemos registrado suficientes llamadas a la API para mostrar estadísticas de disponibilidad de este modelo. Los datos aparecen una vez que el modelo comienza a recibir tráfico en vivo.
Veredictos del benchmark Tokonomix
Aún no hay veredictos de benchmark para este modelo.
FLUX.1 Schnell
por Hugging Face (nscale)
- Ventana de contexto
- — tokens
- Precio de entrada
- — / 1M
- Precio de salida
- — / 1M
- Tier
- Tier B — Producción
- Modalidad
- Texto
- Tipo de API
- REST · streaming
- Ejecuciones benchmark
- 114
Más de Hugging Face (nscale)