Aller au contenu
Tier C — Spécialiste
Fonctionne en :USCréé en :United States
$10.00
sortie · par 1M de tokens (coût de base)
Coût
1,003 ms
Vitesse de réponse
100 / 100
Intelligence

Verdict — résuméLIVE

LIVE
maintenant · 2026-07-26

Quality decline and slower responses across tested categories

Quality dropped 6.8 points Latency increased 46% Multilingual remains at 100 Creative performance declined

This benchmark window reveals a significant performance regression for gpt-4o-2024-11-20. Overall quality dropped 6.8 points from 99.3 to 92.5, while latency increased by 46% with median response times rising from 1253ms to 1825ms. The category composition changed between windows, making direct comparisons limited, but the available data shows mixed results. Multilingual capabilities remained exceptional at 100 in both windows, demonstrating consistent strength in language handling. However, creative tasks scored 87 compared to the previous 98, indicating a notable decline in this area. Reasoning achieved a perfect 100 score, while factual performance registered at 83. The previous window's perfect coding score of 100 cannot be compared as coding was not tested in the current window. The substantial latency increase is particularly concerning for real-time applications, representing nearly half a second of additional wait time per request. Users should be aware that this version shows reduced creative capability and slower response times compared to the previous benchmark period, though multilingual and reasoning performance remain strong areas.

Quality

92.5

Latency p50

1,825 ms

Test runs

5

1 sur 15

Image et explicationLIVE

OpenAI

gpt-4o-2024-11-20

Tier C — Spécialiste

Équipe éditoriale Tokonomix·Relu par Mes Kalkan··

GPT-4o-2024-11-20 est un grand modèle de langage développé par OpenAI, sorti en novembre 2024 dans le cadre de la série GPT-4o. Ce modèle constitue une itération de l'architecture multimodale d'OpenAI, bien que dans ce déploiement il soit principalement destiné aux tâches standard de génération de texte. Il est conçu pour la compréhension et la génération de langage à usage général, incluant des tâches telles que la création de contenu, les réponses à des questions, la génération de code, l'analyse et les applications conversationnelles. Le modèle s'appuie sur l'architecture GPT-4 avec des améliorations visant à accroître la qualité des réponses, la cohérence et la capacité à suivre les instructions. Bien que les détails techniques précis concernant le nombre de paramètres et les données d'entraînement n'aient pas été divulgués par OpenAI, le modèle présente des caractéristiques de performance conformes aux modèles de langage de la classe frontière. Il traite des entrées textuelles et produit des sorties textuelles avec des capacités couvrant plusieurs langues et domaines de connaissance, avec une date limite des données d'entraînement fixée à la mi-2023. Au sein de la gamme de modèles d'OpenAI, GPT-4o-2024-11-20 se positionne comme une offre standard de la famille GPT-4o, située entre les anciens modèles GPT-4 et les versions plus récentes d'OpenAI. La désignation « o » dans GPT-4o indique des optimisations pour des scénarios de déploiement pratiques. Cet instantané précis reflète l'état du modèle à sa date de sortie en novembre 2024, et il sert de modèle généraliste recommandé par OpenAI pour les applications nécessitant une génération de texte fiable sans exigences spécialisées de traitement multimodal dans cette configuration.

GPT-4o-2024-11-20, snapshot de novembre 2024, représente une version mature de la série GPT-4o avec des améliorations de qualité.

Synthèse benchmark Tokonomix

Capacités

toolssource: litellmvisionjson modepdf inputjson schemaparallel toolsprompt cachingmax output tokens: 16384
gpt-4o-2024-11-20 — illustration 1
gpt-4o-2024-11-20 : l'instantané 4o de fin 2024

gpt-4o-2024-11-20 est le dernier instantané majeur de GPT-4o publié par OpenAI avant l'arrivée de la famille GPT-4.1. Sorti le 20 novembre 2024, il représente le modèle dans sa forme mature — même surface multimodale que le modèle de lancement, avec les améliorations de raisonnement, de qualité rédactionnelle et de calibration des refus apportées tout au long du second semestre 2024.

Pour les équipes qui font encore tourner 4o en production, c'est généralement le bon pin. Pour les nouveaux projets, la conversation a évolué.

Ce qu'a changé la version de novembre

L'instantané d'août 2024 a capté l'essentiel de l'attention structurelle parce qu'il a apporté les sorties structurées strictes. La version de novembre a été un ensemble plus discret de changements, qui ont compté tout autant en production.

Qualité du raisonnement. Novembre est visiblement plus solide sur les prompts à plusieurs étapes que le modèle de lancement ou que l'instantané d'août. Travail de type chaîne de raisonnement, prompts de planification, synthèse de code inédit à partir d'une spécification floue — tous montrent une amélioration mesurable. Le modèle n'atteint pas le niveau des successeurs ajustés au raisonnement de la famille GPT-5, mais pour la classe 4o, il a constitué le point culminant.

Qualité rédactionnelle. La prose longue issue de cet instantané est nettement moins guindée que celle de la version d'août. La structure des phrases varie davantage, le modèle nuance moins lorsque le prompt ne le justifie pas, et le registre reste plus cohérent d'un paragraphe à l'autre. Les équipes qui font de la rédaction d'articles, du résumé pour direction ou toute génération de texte en production sur 4o ont tendance à se figer sur cet instantané pour cette seule raison.

Calibration des refus. Légèrement moins agressive qu'en août sur les prompts limites. Certaines requêtes légitimes en bordure que l'instantané d'août refusait passent désormais proprement en novembre.

Ce que livre l'instantané

L'intégralité de la surface fonctionnelle de GPT-4o telle qu'elle se présentait en novembre 2024. Entrée texte et image avec une fenêtre de contexte de 128k tokens. L'audio passe par l'API realtime et les endpoints contemporains. Sorties structurées strictes héritées d'août. Mode JSON. Function calling. Streaming sur la surface Chat Completions.

Ce qui ne figure pas dans cet instantané, c'est tout ce qui relève de la famille GPT-4.1. Le contexte d'un million de tokens, les améliorations supplémentaires du raisonnement, la gestion mise à jour du tokeniseur — tout cela reste sur la famille plus récente. Si votre charge de travail bénéficie réellement de ces éléments, la conversation sur la mise à niveau porte sur la famille du modèle, pas seulement sur la date de l'instantané.

Pourquoi les équipes se figent spécifiquement sur novembre

La plupart des pins 4o en production aujourd'hui se posent sur cette date ou sur le tag flottant. Les raisons sont les habituelles.

Régimes de conformité ayant approuvé cet identifiant. L'instantané de novembre est suffisamment récent pour que les cycles d'audit conclus à son sujet restent pertinents, ce qui en fait le 4o pinné le plus approuvé dans les environnements réglementés.

Pipelines aval ajustés au comportement de novembre. Les équipes qui ont bâti autour de la qualité rédactionnelle ou de raisonnement de cet instantané — génération de contenu, services de résumé, boucles d'agents qui dépendent des schémas de décision spécifiques de novembre — se figent dessus pour verrouiller ce comportement.

Report de migration. Pour les équipes qui n'ont pas encore terminé la transition vers GPT-4.1 ou GPT-5, se figer sur novembre offre une cible stable pendant que le travail de migration est en cours. Laisser flotter en production pendant la migration est une recette pour des cibles mouvantes dans les rapports d'évaluation.

Comment il se positionne par rapport à l'état actuel du domaine

GPT-4o dans l'instantané de novembre n'est plus à la frontière. GPT-4.1, GPT-5, ainsi que les familles Claude Opus 4.x et Gemini 3 Pro sont tous nettement en avance sur le raisonnement, le travail en long contexte et les cas limites de sortie structurée.

Ce qui reste à l'avantage de 4o, c'est une histoire de déploiement bien comprise, un point de prix plus convivial que le segment frontière, et une surface audio via gpt-4o-audio et l'API realtime qu'aucun successeur n'a pleinement remplacée pour le travail vocal en production.

Pour la comparaison transversale, voir /benchmarks/leaderboard. Détails de vitesse et d'intelligence sur /benchmarks/speed et /benchmarks/intelligence.

Risque de fin de vie

Cet instantané est le pin 4o le plus récent et donc le plus éloigné de la fin de vie, mais l'horizon de dépréciation est fini. Le cycle habituel de douze à dix-huit mois d'OpenAI s'applique. Planifiez en conséquence.

Le successeur naturel côté famille 4o est le tag flottant, qui reporte la majeure partie du comportement de novembre avec les petites améliorations ultérieures intégrées. Le mouvement tourné vers l'avenir, c'est GPT-4.1 ou GPT-5, selon la charge de travail. Préparez le cycle d'évaluation avant que la date de dépréciation ne soit annoncée.

Schéma de pin

Le schéma qui tient :

  • Pinner en eval, CI et flux audités.
  • Faire flotter sur le trafic de production, où les petites améliorations continues valent plus que la reproductibilité.
  • Diffuser chaque semaine entre le pin et le flottant sur un jeu de prompts fixé pour détecter toute dérive comportementale.

Pour novembre spécifiquement, la dérive du tag flottant par rapport à cet instantané est aujourd'hui suffisamment faible pour que le diff revienne souvent propre. Cela change avec le temps ; ne laissez pas le job de diff sortir du calendrier.

Pour la surface 4o flottante, voir GPT-4o. Pour la famille qui supplante 4o pour les nouveaux projets, voir GPT-4.1.

Quand le choisir

Utilisez gpt-4o-2024-11-20 lorsque :

  • Un régime de conformité a approuvé cet identifiant et qu'il s'agit de votre cycle d'audit le plus récent.
  • Les pipelines aval dépendent de la qualité rédactionnelle ou de raisonnement de cette version spécifique.
  • Vous faites tourner 4o en production et souhaitez un pin stable pendant qu'une migration vers GPT-4.1 est en cours.

Pour les nouveaux projets, visez la famille plus récente. Novembre a été un bon point d'arrivée. Ce n'est plus la tête de file.

Dernière revue technique : 2026-05-22 — Tokonomix.ai

gpt-4o-2024-11-20 — illustration 2

Comparaison des fournisseursLIVE

Comparaison des fournisseurs
Comparez chaque fournisseur de ce modèle — coût de base, qualité, latence et disponibilité.
Azure OpenAI (EU - Sweden)UE
Coût d’entrée$2.75
Coût de sortie$11.00
QualitéPas encore testé
Latence (p50)Pas encore testé
DisponibilitéPas encore testé
Coûts affichés par 1M de tokens (coût de base)
OpenAIUSCette offre
Coût d’entréemeilleur$2.50
Coût de sortie$10.00
Qualitémeilleur100.0
Latence (p50)meilleur1,003 ms
DisponibilitéPas encore testé
Coûts affichés par 1M de tokens (coût de base)

Intelligence de consensus

MODÈLE ENTIER

Les signaux de consensus sont à l’échelle du modèle — pas encore par fournisseur.

8.0

Utilité de l’agent (1–10)

Score de précision

0

Détections uniques

0

Requêtes validées

Gravité des constats

Élevée 100%Moyenne 0%Faible 0%

Votes de la communautéLIVE

Votes de la communauté
Ce que pensent les vrais visiteurs — par fournisseur.
Azure OpenAI (EU - Sweden)UE

Pas encore de votes de la communauté.

OpenAIUS

Pas encore de votes de la communauté.

Plus de résultats — par fournisseur

Qualité par catégorie

CréatifFactuelMultilingueRaisonnement

Grille de jeu

Pas encore de données.

Verdict du juge

OK 95%Partiel 5%Faux 0%

Jeux & arène

Pas encore de données.

Vitesse & santé

1,003 ms

Latence (p50)

Disponibilité

Question & réponse — parcourirLIVE

1 sur 80
🧠 intelligenceOpenAImultilingual · 2026-07-26score: 100

Bir mağazada %20 indirim uygulanıyor. 150 TL olan bir ürün indirimden sonra kaç TL olur?

Bir ürünün indirimli fiyatını hesaplamak için şu adımları izleyebiliriz: 1. **Ürünün indirime tabi olan miktarını hesaplayalım:** %20 indirim demek, ürün fiyatının %20'si kadar bir miktarın fiyatından düşüleceği anlamına gelir. 150 TL'nin %20'si: \( 150 \times 0,20 = 30 \, TL \) 2. **Ürünün indirimli fiyatını bulalım:** \( 150 - 30 = 120 \, TL \) Sonuç: İndirimden sonra ürünün fiyatı **120 TL** olur. 🙂

Historique des tests — tous fournisseursLIVE

Score de qualité dans le tempsdernier 91
05-1507-26
Vitesse — latence p50 dans le temps

Une tendance apparaît une fois ce modèle testé sur plusieurs jours.