Aller au contenu
Fonctionne en :SGCréé en :China
Alibaba Cloud Qwen (DashScope Intl)

Qwen3.7 Plus

Tier B — Production · 1M tokens

Équipe éditoriale Tokonomix·Relu par Mes Kalkan··
Section 01

Analyse de vitesse

Latence mesurée sur toutes les exécutions de benchmark. P50 (médiane) et P95 (95e percentile) donnent une image réaliste de la vitesse de réponse en charge normale et de pointe.

Latence P50 (médiane)Latence P954 runs
1265139015151639176407-3007-31ms
Section 02

Historique des tarifs

Tarifs directs du fournisseur par million de tokens, plus une estimation du coût d'une conversation typique.

💰
Tarifs API — Qwen3.7 Plus
$0.3200 par 1M de tokens d'entrée
$1.28 par 1M de tokens de sortie
≈ $0.0004 par conversation typique (800 tokens)
Prix entrée vs sortie (par 1M de tokens)
par 1M de tokens d'entrée$0.3200
par 1M de tokens de sortie$1.28
No pricing history yet — will populate after the first metadata sync detects a price change.
Section 03

Tokens par seconde

Débit en tokens par seconde, dérivé de la latence P50 mesurée. Plus haut est mieux ; les fluctuations reflètent la charge côté fournisseur.

Débit (tokens / s)136 / avg 134
157104

Estimé à partir de la latence P50 × 200 tokens de sortie — le chiffre absolu dépend de cette hypothèse ; c'est la tendance qui compte.

Section 04

Disponibilité

Disponibilité

La fréquence à laquelle ce modèle répond lorsqu'on l'appelle — mesurée sur de vraies requêtes API et des tests en direct au cours des 30 derniers jours. C'est indépendant de la qualité : ces chiffres indiquent seulement si le modèle répond, pas la qualité de sa réponse.

7 derniers jours

100.0%

n=1

30 derniers jours

100.0%

n=1

Temps de réponse médian

4,988ms

n=1

Basé sur 13 mesures au cours des 30 derniers jours.

Détails techniques

Seuls les vrais appels API et les requêtes de test en direct sont comptés — les sondes internes et les benchmarks sont exclus.

Les appels avec une clé API personnalisée (BYOK) sont exclus : ces échecs sont spécifiques à la clé, pas un signe de défaillance du modèle.

Les appels échoués ne sont PAS inclus dans les scores de qualité — la qualité est mesurée uniquement sur les réponses réussies. Disponibilité et qualité sont des signaux indépendants.

Temps de réponse médian (p50) sur les appels réussis avec une durée enregistrée. Les valeurs extrêmes influencent moins la médiane que la moyenne.

Total des appels (30d)

1

Réponses OK (30d)

1

Total des appels (7d)

1

Réponses OK (7d)

1

Section 05

Verdicts benchmark Tokonomix

No benchmark verdicts yet for this model.

Dernier test automatisé
31 juil. 2026 · 14:03 UTC · Benchmark de vitesse
Latence P50
1471 ms
Latence P95
1587 ms
Erreurs
0 / 4 exécutions
Dernière revue par Équipe Tokonomix·31 juillet 2026