Geschwindigkeitsanalyse
Latenz über alle Benchmark-Läufe gemessen. P50 (Median) und P95 (95. Perzentil) zeigen ein realistisches Bild der Antwortgeschwindigkeit bei normaler und Spitzenlast.
Tokens pro Sekunde
Durchsatz in Tokens pro Sekunde, abgeleitet aus gemessener P50-Latenz. Höhere Werte sind besser; Schwankungen spiegeln die Provider-seitige Last wider.
Geschätzt aus P50-Latenz × 200 Output-Tokens — die absolute Zahl hängt von dieser Annahme ab; entscheidend ist der Trend.
Fähigkeiten
Verfügbarkeit
Verfügbarkeit
Noch keine Messdaten
Es wurden noch nicht genug API-Aufrufe aufgezeichnet, um Verfügbarkeitsstatistiken für dieses Modell anzuzeigen. Daten erscheinen, sobald das Modell Live-Traffic erhält.
Tokonomix-Benchmark-Urteile
Noch keine Benchmark-Urteile für dieses Modell.
FLUX.1 Schnell
von Hugging Face (nscale)
- Kontextfenster
- — tokens
- Eingabepreis
- — / 1M
- Ausgabepreis
- — / 1M
- Tier
- Tier B — Produktion
- Modalität
- Text
- API-Typ
- REST · Streaming
- Benchmark-Läufe
- 114
Mehr von Hugging Face (nscale)