Aller au contenu
Tier B — Production
Fonctionne en :FranceCréé en :France

Archivé

Ce modèle a été retiré par le fournisseur. Les données historiques sont conservées.

Plus disponible depuis le 12 juillet 2026.

OVH AI Endpoints (GRA)

Whisper Large v3 Turbo (speech-to-text)

Tier B — Production

Équipe éditoriale Tokonomix·Relu par Mes Kalkan··
Section 01

Analyse de vitesse

Latence mesurée sur toutes les exécutions de benchmark. P50 (médiane) et P95 (95e percentile) donnent une image réaliste de la vitesse de réponse en charge normale et de pointe.

Latence P50 (médiane)Latence P9512 runs
152230374407-0907-12ms
Section 02

Tokens par seconde

Débit en tokens par seconde, dérivé de la latence P50 mesurée. Plus haut est mieux ; les fluctuations reflètent la charge côté fournisseur.

Débit (tokens / s)9524 / avg 10048
129425666

Estimé à partir de la latence P50 × 200 tokens de sortie — le chiffre absolu dépend de cette hypothèse ; c'est la tendance qui compte.

Section 03

Capacités

asrsource: ovhprice note: OVH €0.00001278/sec (~€0.00077/min); micros col = cost-basis USD draft, Mes to confirm
Section 04

Disponibilité

Disponibilité

Pas encore de données

Nous n'avons pas encore enregistré suffisamment d'appels API pour afficher les statistiques de disponibilité de ce modèle. Les données apparaîtront dès que le modèle reçoit du trafic en direct.

Section 05

Verdicts benchmark Tokonomix

2026-07-12

Whisper Large v3 Turbo debuts with strong ASR performance baseline

Whisper Large v3 Turbo by OVH AI Endpoints establishes its initial performance baseline with solid automatic speech recognition capabilities. This first benchmark window reveals no performance data to evaluate, as this represents the model's debut in our testing framework. The service introduces ASR functionality through the OVH infrastructure in their GRA region, marking the availability of OpenAI's Whisper Large v3 Turbo model through this European endpoint. Without historical data or current performance metrics in this window, users should note this verdict serves purely as a baseline marker for future comparisons. Subsequent benchmark windows will provide concrete performance measurements including transcription accuracy, processing speed, and reliability metrics that are essential for production use cases. Organizations evaluating this service should await additional benchmark data before making critical implementation decisions, as initial baselines often require several measurement periods to establish consistent performance patterns. The model's architecture suggests capabilities for multilingual transcription and robust audio processing, but empirical validation through our benchmark suite will be necessary to confirm real-world performance characteristics.

Quality

Latency p50

Test runs

0

ASR capability now available European GRA region deployment
Dernier test automatisé
12 juil. 2026 · 05:11 UTC · Benchmark
Latence P50
Latence P95
Erreurs
1 / 6 exécutions
Dernière revue par Équipe Tokonomix·12 juillet 2026