Aller au contenu
Tier B — Production
Fonctionne en :USCréé en :United States
$10.00
sortie · par 1M de tokens (coût de base)
Coût
1,317 ms
Vitesse de réponse
100 / 100
Intelligence

Verdict — résuméLIVE

LIVE
maintenant · 2026-07-26

Quality decline and significant latency regression observed

Latency increased 162% Overall quality dropped 2.8 points Factual accuracy declined to 91 Perfect reasoning and multilingual scores

This benchmark window reveals a notable performance regression for GPT-5.1. The overall quality score decreased from 99.7 to 96.9, representing a 2.8-point drop that suggests meaningful capability changes. Most concerning is the latency increase of 162 percent, with median response time rising from 1359ms to 3555ms. This substantially impacts user experience across all use cases. Category performance shows a mixed picture. Reasoning and multilingual capabilities achieved perfect scores of 100, demonstrating strong performance in these domains. The multilingual score maintained its previous perfect rating. However, factual accuracy dropped to 91, a concerning regression in a critical capability area. Creative writing remained strong at 97, though this represents a slight decrease from the previous 99. The coding category, which scored perfectly in the prior window, was not measured in the current evaluation period. Users should expect noticeably slower response times compared to the previous version, which may affect real-time applications and conversational flows. The quality decline, while not catastrophic, suggests this version may be less reliable for fact-intensive tasks. The maintained excellence in reasoning and multilingual tasks provides some reassurance for those specific workloads.

Quality

96.9

Latency p50

3,555 ms

Test runs

5

1 sur 11

Image et explicationLIVE

OpenAI

gpt-5.1-2025-11-13

Tier B — Production

Équipe éditoriale Tokonomix·Relu par Mes Kalkan··

GPT-5.1-2025-11-13 est un grand modèle de langage développé par OpenAI, publié en novembre 2025 dans le cadre de la série GPT-5. Ce modèle représente une mise à jour itérative de la gamme phare de modèles de langage d'OpenAI, intégrant des améliorations architecturales et un entraînement sur des données plus récentes par rapport à ses prédécesseurs. Il est conçu pour des tâches de génération de texte à usage général, notamment la compréhension du langage naturel, la création de contenu, les réponses aux questions, la génération de code et les applications conversationnelles. Le modèle dispose de capacités standard de génération de texte avec prise en charge du raisonnement complexe, du dialogue multi-tours et du suivi d'instructions. Bien que la taille exacte de la fenêtre de contexte n'ait pas été divulguée publiquement, il devrait gérer des longueurs d'entrée substantielles conformément aux grands modèles de langage modernes. GPT-5.1 s'appuie sur les fondations établies par la série GPT-5, offrant des performances améliorées sur les benchmarks de raisonnement et une précision factuelle accrue grâce aux mises à jour de la date limite de ses données d'entraînement. Au sein de la gamme de modèles d'OpenAI, GPT-5.1-2025-11-13 se positionne comme une offre de génération actuelle dans la famille GPT-5. L'identifiant de version horodaté indique qu'il s'agit d'un instantané spécifique publié en novembre 2025, reflétant la pratique d'OpenAI de fournir des versions datées pour garantir cohérence et reproductibilité. Ce modèle sert les utilisateurs nécessitant des capacités fiables de modèle de langage à usage général pour des applications de production, la recherche et le développement dans divers domaines.

GPT-5.1-2025-11-13 représente l'évolution naturelle de la série GPT-5 d'OpenAI, avec un accent renforcé sur le raisonnement complexe et la précision factuelle grâce à des données d'entraînement actualisées jusqu'en novembre 2025.

Analyse Tokonomix, décembre 2025

Capacités

toolssource: litellmvisionjson modepdf inputreasoningjson schemaparallel toolsprompt cachingmax output tokens: 128000
gpt-5.1-2025-11-13 — illustration 1
gpt-5.1-2025-11-13 : le gel GPT-5.1 de novembre 2025

gpt-5.1-2025-11-13 est l'instantané daté de novembre 2025 de la gamme GPT-5.1 d'OpenAI. Il s'agit du gel de l'alias glissant gpt-5.1 dans son état à la date de sortie de la 5.1, figé pour les déploiements en production qui souhaitent s'aligner sur un comportement spécifique.

Pour les équipes qui ont mené l'évaluation 5.1, validé leurs charges de production contre le comportement du jour du lancement, et qui veulent conserver ce comportement exact pendant qu'OpenAI continue de livrer des affinements via l'alias glissant — c'est l'instantané à épingler.

Ce que représente cet instantané

La version de novembre 2025 constitue le gel initial de GPT-5.1. À cette date, le modèle disposait de :

  • L'ensemble complet des affinements 5.1 par rapport à 5.0 — meilleure conformité aux schémas JSON, comportement d'utilisation d'outils plus rigoureux, variance réduite sur les prompts de cas limites, posture de refus affinée.
  • La fenêtre de contexte et le profil d'attention de la gamme 5.1 tels qu'ils étaient au lancement.
  • Le comportement d'entrée visuelle calibré selon les standards de la gamme 5.1.

Ce qu'il ne possède pas, par rapport à ce qui s'est accumulé dans l'alias glissant gpt-5.1 depuis :

  • Les affinements intra-version qu'OpenAI a livrés depuis le lancement — petites améliorations de précision, ajustements supplémentaires des refus, optimisations de latence.
  • La compatibilité avec les fonctionnalités d'API plus récentes qui ont pu être ajoutées après la date de l'instantané.

Pour un déploiement en production qui a été validé contre le comportement de lancement de novembre 2025, ces mises à jour intra-version sont précisément les changements contre lesquels l'épinglage vous protège. Ce sont des améliorations en moyenne ; elles peuvent constituer des régressions sur les cas limites spécifiques autour desquels votre évaluation a été calibrée.

Pourquoi épingler une version 5.1 datée a du sens

L'argument en faveur de l'épinglage de l'instantané daté GPT-5.1 plutôt que de l'exécution sur l'alias glissant est l'argument classique de stabilité en production :

  • Les changements de comportement entre les mises à jour intra-version peuvent casser des modèles de prompts qui ont été calibrés selon des particularités spécifiques.
  • Les évolutions de conformité aux schémas peuvent modifier les résultats de parsing en aval même lorsque le comportement principal reste inchangé.
  • Les évolutions de la posture de refus peuvent produire des messages de refus dans des scénarios qui fonctionnaient auparavant, et inversement.
  • Les audits de conformité exigent souvent un épinglage explicite à l'instantané plutôt qu'un usage d'alias glissant.

Le coût, c'est de renoncer aux améliorations intra-version. Le bénéfice, c'est un comportement de production prévisible. Pour les produits livrés disposant d'utilisateurs établis, l'arbitrage vaut généralement la peine d'être pris.

La question de la migration

Pour les instantanés datés de gammes de modèles matures, la question de la migration se divise en deux directions : vers l'avant à l'intérieur de la version (vers ce que l'alias glissant a accumulé) et vers l'avant à travers les versions (vers GPT-5.2 ou ce qu'OpenAI a publié ensuite).

La migration intra-version est généralement la voie la moins risquée. La même gamme de modèles, le même comportement général, avec les affinements intra-version accumulés. Revalidez votre suite d'évaluation, migrez lorsque les mises à jour intra-version l'emportent de manière démontrable.

La migration inter-versions constitue le changement plus important. GPT-5.2 possède son propre comportement caractéristique qui diffère de 5.1 d'une manière qui va au-delà de la dérive intra-version. La revalidation est plus lourde et la cible de migration est mouvante tant que la gamme 5.2 elle-même ne dispose pas d'instantanés datés à épingler.

Là où il pèche

Mêmes contraintes que le reste de la gamme GPT-5.

Niveau de coût. Les déclinaisons mini et nano sont le bon choix pour les charges où le dimensionnement frontière est surdimensionné.

Latence. La latence de niveau frontière est plus élevée que celle des déclinaisons plus petites.

Pas d'audio, de voix temps réel ni de vidéo. Utilisez les endpoints spécialisés.

Déploiement auto-hébergé indisponible.

Charges à forte génération de code où les variantes codex constituent le meilleur choix.

Quand épingler exactement cet instantané

Choisissez gpt-5.1-2025-11-13 lorsque :

  • Vous avez livré un produit en production sur le comportement de lancement GPT-5.1 de novembre 2025 et devez le maintenir stable.
  • Une exigence de conformité impose l'épinglage de la version du modèle au niveau de l'instantané.
  • Vous êtes en pleine évaluation de mises à jour intra-version ou de GPT-5.2 et avez besoin d'une base de production stable pendant l'évaluation.

Évitez-le lorsque :

  • Vous démarrez à zéro — l'alias glissant gpt-5.1 ou gpt-5.1-chat-latest constitue le défaut plus pragmatique pour le développement actif.
  • Les mises à jour intra-version l'ont emporté de manière démontrable lors de votre évaluation.
  • La version 5.2 a remporté l'évaluation face à 5.1 sur les dimensions qui comptent pour votre produit.
  • Un autre modèle du catalogue est mieux adapté à la charge — mini/nano pour le niveau de coût, codex pour le code, déclinaisons audio pour la voix.

Alternatives à comparer

L'alias glissant gpt-5.1 lorsque vous voulez les mises à jour intra-version sans gérer la migration. gpt-5.1-chat-latest pour les cas d'usage conversationnels optimisés contre l'étiquette glissante. gpt-5.2 lorsque l'évaluation de la version plus récente l'a emporté. Les déclinaisons mini et nano pour les charges sensibles au coût. Les variantes codex pour les travaux à forte composante de code.

Notes de déploiement

API Chat Completions standard. L'épinglage de l'instantané est purement un choix de nom de modèle ; la surface d'API, le comportement d'entrée visuelle, la gestion des sorties structurées et l'ergonomie d'utilisation des outils sont inchangés par rapport à leur état le jour du lancement de la 5.1.

Facturation des tokens aux tarifs de niveau frontière GPT-5. L'épinglage de l'instantané ne modifie pas la structure de coût par rapport à l'alias glissant.

La lecture pragmatique. Il s'agit du gel de novembre 2025 de GPT-5.1. Épinglez-le lorsque votre produit en production a été validé contre le comportement de lancement et que la stabilité au niveau de l'instantané importe. Migrez intra-version ou inter-versions lorsque votre propre évaluation indique que l'étape suivante constitue le bon mouvement. Comparez face aux alternatives sur /live-test avant de vous engager.

Dernière revue technique : 2026-05-22 — Tokonomix.ai

gpt-5.1-2025-11-13 — illustration 2gpt-5.1-2025-11-13 — illustration 3

Comparaison des fournisseursLIVE

Comparaison des fournisseurs
Comparez chaque fournisseur de ce modèle — coût de base, qualité, latence et disponibilité.
Azure OpenAI (EU - Sweden)UE
Coût d’entréemeilleur$1.25
Coût de sortie$10.00
QualitéPas encore testé
Latence (p50)Pas encore testé
DisponibilitéPas encore testé
Coûts affichés par 1M de tokens (coût de base)
OpenAIUSCette offre
Coût d’entrée$1.25
Coût de sortie$10.00
Qualitémeilleur100.0
Latence (p50)meilleur1,317 ms
DisponibilitéPas encore testé
Coûts affichés par 1M de tokens (coût de base)

Intelligence de consensus

MODÈLE ENTIERDORMANT

Les signaux de consensus sont à l’échelle du modèle — pas encore par fournisseur.

Le scoring de consensus collecte encore des données pour ce modèle — aucun signal pour l’instant.

Votes de la communautéLIVE

Votes de la communauté
Ce que pensent les vrais visiteurs — par fournisseur.
Azure OpenAI (EU - Sweden)UE

Pas encore de votes de la communauté.

OpenAIUS

Pas encore de votes de la communauté.

Plus de résultats — par fournisseur

Qualité par catégorie

CréatifFactuelMultilingueRaisonnement

Grille de jeu

Pas encore de données.

Verdict du juge

OK 100%Partiel 0%Faux 0%

Jeux & arène

Pas encore de données.

Vitesse & santé

1,317 ms

Latence (p50)

Disponibilité

Question & réponse — parcourirLIVE

1 sur 80
🧠 intelligenceOpenAImultilingual · 2026-07-26score: 100

Bir mağazada %20 indirim uygulanıyor. 150 TL olan bir ürün indirimden sonra kaç TL olur?

150 TL’lik ürüne %20 indirim: %20’si = 150 × 0,20 = 30 TL İndirimli fiyat = 150 − 30 = **120 TL**

Historique des tests — tous fournisseursLIVE

Score de qualité dans le tempsdernier 97
06-2807-26
Vitesse — latence p50 dans le temps

Une tendance apparaît une fois ce modèle testé sur plusieurs jours.