Ir al contenido
Se ejecuta en:SGCreado en:China
Alibaba Cloud Qwen (DashScope Intl)

Qwen3.7 Max

Tier A — Frontera · 1M tokens

Equipo editorial Tokonomix·Revisado por Mes Kalkan··
Sección 01

Análisis de velocidad

Latencia medida en todas las ejecuciones de benchmark. P50 (mediana) y P95 (percentil 95) dan una imagen realista de la velocidad de respuesta bajo carga normal y máxima.

Latencia P50 (mediana)Latencia P954 runs
1179205529313807468307-3007-31ms
Sección 02

Historial de precios

Tarifas directas del proveedor por millón de tokens, más una estimación del coste de una conversación típica.

💰
Tarifas API — Qwen3.7 Max
$1.25 por 1M de tokens de entrada
$3.75 por 1M de tokens de salida
≈ $0.0015 por conversación típica (800 tokens)
Precio entrada vs salida (por 1M de tokens)
por 1M de tokens de entrada$1.25
por 1M de tokens de salida$3.75
No pricing history yet — will populate after the first metadata sync detects a price change.
Sección 03

Tokens por segundo

Rendimiento en tokens por segundo, derivado de la latencia P50 medida. Más alto es mejor; las fluctuaciones reflejan la carga del lado del proveedor.

Rendimiento (tokens / s)146 / avg 125
16863

Estimado a partir de latencia P50 × 200 tokens de salida — el número absoluto depende de esta suposición; lo que importa es la tendencia.

Sección 04

Disponibilidad

Disponibilidad

Con qué frecuencia responde este modelo cuando lo llamamos — medido en solicitudes reales de API y pruebas en vivo durante los últimos 30 días. Esto es independiente de la calidad: estos números solo indican si el modelo responde, no qué tan buena es la respuesta.

Últimos 7 días

100.0%

n=1

Últimos 30 días

100.0%

n=1

Tiempo de respuesta mediano

4,171ms

n=1

Basado en 13 mediciones en los últimos 30 días.

Detalles técnicos

Solo cuentan las llamadas reales a la API y las solicitudes de prueba en vivo — las sondas internas y las ejecuciones de referencia están excluidas.

Las llamadas con una clave API propia (BYOK) están excluidas: esos fallos son específicos de la clave, no una señal de inactividad del modelo.

Las llamadas fallidas NO se incluyen en las puntuaciones de calidad — la calidad se mide solo en respuestas exitosas. Disponibilidad y calidad son señales independientes.

Tiempo de respuesta mediano (p50) en llamadas exitosas con una duración registrada. Los valores atípicos afectan menos a la mediana que a la media.

Total de llamadas (30d)

1

Respuestas OK (30d)

1

Total de llamadas (7d)

1

Respuestas OK (7d)

1

Sección 05

Veredictos del benchmark Tokonomix

No benchmark verdicts yet for this model.

Última prueba automática
31 jul 2026 · 14:03 UTC · Benchmark de velocidad
Latencia P50
1369 ms
Latencia P95
2978 ms
Errores
0 / 4 ejecuciones
Última revisión por Equipo Tokonomix·31 de julio de 2026