Analyse de vitesse
Latence mesurée sur toutes les exécutions de benchmark. P50 (médiane) et P95 (95e percentile) donnent une image réaliste de la vitesse de réponse en charge normale et de pointe.
Tokens par seconde
Débit en tokens par seconde, dérivé de la latence P50 mesurée. Plus haut est mieux ; les fluctuations reflètent la charge côté fournisseur.
Estimé à partir de la latence P50 × 200 tokens de sortie — le chiffre absolu dépend de cette hypothèse ; c'est la tendance qui compte.
Capacités
Disponibilité
Disponibilité
Pas encore de données
Nous n'avons pas encore enregistré suffisamment d'appels API pour afficher les statistiques de disponibilité de ce modèle. Les données apparaîtront dès que le modèle reçoit du trafic en direct.
Verdicts benchmark Tokonomix
Pas encore de verdicts de benchmark pour ce modèle.
FLUX.1 Schnell
par Hugging Face (nscale)
- Fenêtre de contexte
- — tokens
- Prix d'entrée
- — / 1M
- Prix de sortie
- — / 1M
- Tier
- Tier B — Production
- Modalité
- Texte
- Type d'API
- REST · streaming
- Exécutions benchmark
- 114
Plus de Hugging Face (nscale)