Ir al contenido
Tier B — Producción
Se ejecuta en:FranceCreado en:France

Archivado

Este modelo ha sido descontinuado por el proveedor. Los datos históricos se conservan.

Ya no está disponible desde el 12 de julio de 2026.

OVH AI Endpoints (GRA)

Whisper Large v3 Turbo (speech-to-text)

Tier B — Producción

Equipo editorial Tokonomix·Revisado por Mes Kalkan··
Sección 01

Análisis de velocidad

Latencia medida en todas las ejecuciones de benchmark. P50 (mediana) y P95 (percentil 95) dan una imagen realista de la velocidad de respuesta bajo carga normal y máxima.

Latencia P50 (mediana)Latencia P9512 runs
152230374407-0907-12ms
Sección 02

Tokens por segundo

Rendimiento en tokens por segundo, derivado de la latencia P50 medida. Más alto es mejor; las fluctuaciones reflejan la carga del lado del proveedor.

Rendimiento (tokens / s)9524 / avg 10048
129425666

Estimado a partir de latencia P50 × 200 tokens de salida — el número absoluto depende de esta suposición; lo que importa es la tendencia.

Sección 03

Capacidades

asrsource: ovhprice note: OVH €0.00001278/sec (~€0.00077/min); micros col = cost-basis USD draft, Mes to confirm
Sección 04

Disponibilidad

Disponibilidad

Sin datos todavía

Aún no hemos registrado suficientes llamadas a la API para mostrar estadísticas de disponibilidad de este modelo. Los datos aparecen una vez que el modelo comienza a recibir tráfico en vivo.

Sección 05

Veredictos del benchmark Tokonomix

2026-07-12

Whisper Large v3 Turbo debuts with strong ASR performance baseline

Whisper Large v3 Turbo by OVH AI Endpoints establishes its initial performance baseline with solid automatic speech recognition capabilities. This first benchmark window reveals no performance data to evaluate, as this represents the model's debut in our testing framework. The service introduces ASR functionality through the OVH infrastructure in their GRA region, marking the availability of OpenAI's Whisper Large v3 Turbo model through this European endpoint. Without historical data or current performance metrics in this window, users should note this verdict serves purely as a baseline marker for future comparisons. Subsequent benchmark windows will provide concrete performance measurements including transcription accuracy, processing speed, and reliability metrics that are essential for production use cases. Organizations evaluating this service should await additional benchmark data before making critical implementation decisions, as initial baselines often require several measurement periods to establish consistent performance patterns. The model's architecture suggests capabilities for multilingual transcription and robust audio processing, but empirical validation through our benchmark suite will be necessary to confirm real-world performance characteristics.

Quality

Latency p50

Test runs

0

ASR capability now available European GRA region deployment
Última prueba automática
12 jul 2026 · 05:11 UTC · Benchmark
Latencia P50
Latencia P95
Errores
1 / 6 ejecuciones
Última revisión por Equipo Tokonomix·12 de julio de 2026