Zum Inhalt
Tier C — Spezialist

Einstellungsdatum

Der Anbieter stellt dieses Modell am 23. Oktober 2026 ein. Bis dahin funktioniert es wie gewohnt.

Läuft in:USErstellt in:United States
$19.50
Ausgabe · pro 1M Tokens
Kosten
544 ms
Antwortgeschwindigkeit
1101
Intelligenz

Verdict — ZusammenfassungLIVE

LIVE
jetzt · 2026-09-13

Quality drops 15.7 points with factual performance decline

Quality dropped 15.7 points Factual performance fell to 53 Coding remains stable at 92 Latency increased 9 percent

The gpt-4o-2024-05-13 model experienced a significant quality decline in the current benchmark window, dropping from 94.7 to 79.0 overall. This 15.7 point decrease represents a notable regression from the previous period's strong performance. The most dramatic change appears in category scoring, where factual performance plummeted to 53 points compared to the previous window's scores. While coding performance remained stable at 92 across both windows, demonstrating consistency in this critical domain, the absence of multilingual and creative category scores in the current window makes direct comparison incomplete. Reasoning performance at 92 shows the model maintains strong logical capabilities. Latency increased modestly from 1538ms to 1679ms at the median, representing a 9 percent slowdown that may impact user experience in latency-sensitive applications. The factual category weakness is particularly concerning given its importance for information retrieval and knowledge-based tasks. Users relying on this model for factual accuracy should exercise additional verification, while those prioritizing coding and reasoning tasks will find performance remains robust. The quality regression warrants attention to determine whether this represents a temporary anomaly or systematic issue.

Qualität

79.0

Latenz p50

1,679 ms

Testläufe

5

1 von 20

Bild & ErklärungLIVE

OpenAI

gpt-4o-2024-05-13

Tier C — Spezialist

Tokonomix-Redaktionsteam·Geprüft von Mes Kalkan··

GPT-4o-2024-05-13 ist ein großes multimodales Sprachmodell, das von OpenAI entwickelt und im Mai 2024 veröffentlicht wurde. Dieses Modell stellt OpenAIs erste Iteration der GPT-4o-Serie dar, wobei die Bezeichnung "o" eine Optimierung für sowohl Text- als auch multimodale Eingaben kennzeichnet. Es ist für allgemeine Textgenerierungsaufgaben konzipiert, einschließlich Konversation, Content-Erstellung, Analyse, Programmierunterstützung und Reasoning über verschiedene Bereiche hinweg. Das Modell verarbeitet Texteingaben und generiert Textausgaben mit Fähigkeiten, die mehrere Sprachen und technische Fachgebiete umfassen. Diese Version dient als initiale Produktionsveröffentlichung der GPT-4o-Architektur und bietet standardmäßige Textgenerierungsfähigkeiten, die Performance mit Zugänglichkeit in Einklang bringen. Während spezifische Architekturdetails proprietär bleiben, baut das Modell auf der Grundlage auf, die durch frühere GPT-4-Varianten geschaffen wurde, und führt architektonische Verfeinerungen ein, die auf verbesserte Effizienz und Antwortqualität abzielen. Das Modell unterstützt erweiterte Konversationen und komplexe Anweisungen, was es für Anwendungen geeignet macht, die von einfachen Frage-Antwort-Aufgaben bis hin zu anspruchsvollen analytischen Tasks reichen. Innerhalb von OpenAIs Modell-Lineup nimmt GPT-4o-2024-05-13 eine zentrale Position als Flaggschiff-Modell für allgemeine Zwecke ein. Es steht neben anderen GPT-4-Varianten im Angebot von OpenAI und bietet eine Alternative zu früheren GPT-4-Versionen und der kompakteren GPT-3.5-Serie. Das Modell ist für Nutzer positioniert, die fortgeschrittene Sprachverständnis- und Generierungsfähigkeiten benötigen, ohne die spezialisierten Features von domänenspezifischen oder experimentellen Varianten. Dieser Snapshot repräsentiert den Stand des Modells zum Zeitpunkt seiner Veröffentlichung im Mai 2024.

Der erste GPT-4o-Snapshot vom Mai 2024: die Erstversion von OpenAIs Omni-Architektur in der Produktionsumgebung.

Tokonomix-Benchmark-Zusammenfassung

Fähigkeiten

toolssource: litellmvisionpdf inputparallel toolsprompt cachingmax output tokens: 4096
gpt-4o-2024-05-13 — illustration 1
gpt-4o-2024-05-13: die Launch-Momentaufnahme

gpt-4o-2024-05-13 ist das ursprüngliche GPT-4o-Release, eingefroren auf den Stand der ersten öffentlichen Verfügbarkeit des Modells am 13. Mai 2024. Es ist der datierte Pin für OpenAIs erstes multimodales Modell der ersten Generation — jenes, das einheitliches Text-Bild-Audio-Verhalten einführte und die Erwartungen des Feldes an die Oberfläche eines Frontier-Modells neu definierte.

Für die meisten Teams ist dieser Snapshot mittlerweile zu alt, um empfohlen zu werden. Für die enge Auswahl an Fällen, in denen Reproduzierbarkeit gegen das Launch-Modell wichtiger ist als jede nachfolgende Verbesserung, bleibt er verfügbar.

Warum genau dieses Datum zählt

Mit dem Launch am 13. Mai 2024 hörte Multimodalität auf, ein Forschungsdemo zu sein, und wurde zum Deployment-Ziel. Frühere GPT-4-Varianten hatten Vision-Unterstützung, aber die Audio-Oberfläche und die niedrigere Latenz bei Text waren der Beitrag von 4o. Teams, die Evaluierungen eingereicht oder Anbieterverträge gegen das Launch-Modell formuliert haben, wollen einen stabilen Referenzpunkt; dieser Snapshot ist dieser Referenzpunkt.

Zwei konkrete Gründe, sich um genau dieses Datum zu kümmern.

Erstens: Vergleichsarbeit. Forschungsteams, die über Modellfähigkeiten über Generationen hinweg schreiben, benötigen ein Modell, das sich nicht still unter ihren Experimenten verändert hat. Der Launch-Snapshot ist das Modell, das in den ursprünglichen OpenAI-Release-Notes und in den meisten Drittanbieter-Evaluierungsarbeiten aus der Mitte des Jahres 2024 bewertet wurde.

Zweitens: regulierte Deployments, die gegen das Launch-Modell genehmigt wurden. Einige Compliance-Regime verlangen, dass jedes Modell, das mit Produktionsdaten in Berührung kommt, einen bestimmten Evaluierungszyklus durchlaufen hat. Wenn Ihr Auditor das Release vom Mai 2024 genehmigt hat und die Migration auf einen neueren Snapshot noch nicht durch die Prüfung ist, ist dies das Modell, das Sie betreiben.

Was in diesem Snapshot ausgeliefert wird

Alles, was OpenAI am Launch-Tag ausgeliefert hat. Text- und Bildeingabe mit einem 128k-Token-Kontextfenster. Audio-Oberflächen über die zeitgleichen Endpunkte. JSON-Modus, aber nicht das spätere Feature der strukturierten Ausgaben — das kam mit dem Release vom 6. August 2024. Function Calling. Streaming. Die Chat-Completions-Oberfläche; die Responses-Oberfläche wurde später hinzugefügt und ist nicht Teil des Verhaltens dieses Snapshots.

Was in diesem Snapshot nicht enthalten ist, ist alles, was in den späteren 4o-Releases gelandet ist. Das Update vom 6. August fügte strikte strukturierte Ausgaben hinzu und straffte das JSON-Modus-Verhalten. Das Update vom 20. November brachte Verbesserungen bei Reasoning und Schreibqualität. Keines davon ist im Mai-Snapshot enthalten. Wenn Ihre nachgelagerte Pipeline von einem bestimmten Verhalten bei strukturierten Ausgaben abhängt, prüfen Sie, gegen welchen Snapshot sie gebaut wurde, bevor Sie annehmen, dass der Mai-Pin die richtige Wahl ist.

Sunset-Risiko

Dies ist der älteste 4o-Snapshot, der noch routinemäßig verfügbar ist, was bedeutet, dass er seinem Sunset-Datum am nächsten ist. OpenAIs typischer Deprecation-Horizont für datierte Snapshots reicht von zwölf bis achtzehn Monaten ab Release. Das Launch-Modell vom Mai 2024 hat das frühe Ende dieses Zeitfensters bereits überschritten.

Planen Sie die Migration aktiv. Beachten Sie, dass „der Snapshot antwortet heute noch" keine Garantie dafür ist, dass er morgen noch antworten wird. Setzen Sie eine Kalendererinnerung, führen Sie eine erneute Evaluierung gegen gpt-4o-2024-11-20 oder gegen den schwebenden gpt-4o-Tag durch, um den Verhaltens-Delta als Baseline festzulegen, und halten Sie die Migration bereit, bevor das Deprecation-Datum angekündigt wird, und nicht erst danach.

Teams, die auf die Deprecation-Mail warten, entdecken in der Regel, dass ihre Produktionspipeline von einem bestimmten Verhalten des Launch-Snapshots abhing, das die neueren Snapshots stillschweigend verändert haben. Die Migrationsarbeit ist teurer, wenn man sie unter Zeitdruck durchführt.

Was sich zwischen diesem und späteren Snapshots geändert hat

Die Verhaltens-Deltas, die es zu kennen lohnt, wenn Sie entscheiden, ob Sie beim Launch-Pin bleiben oder weiterziehen wollen.

Strukturierte Ausgaben. Der Mai-Snapshot unterstützt JSON-Modus, erzwingt Schemata aber nicht so strikt wie das August-Release. Nachgelagerte Parser, die sich auf Schema-Validierung stützen, können gegen diesen Snapshot häufiger fehlschlagen.

Verweigerungs-Kalibrierung. Das Launch-Modell ist bei bestimmten Verweigerungsmustern aggressiver als spätere Snapshots. Einige legitime Prompts werden hier abgelehnt, die im November sauber durchgehen.

Reasoning. Der November-Snapshot ist bei mehrstufigen Prompts sichtbar stärker. Für Workloads, die die Reasoning-Qualität testen, ist die Lücke substanziell.

Latenz. Verbesserungen am Inferenz-Stack im Verlauf des Jahres 2024 bedeuten, dass der schwebende Tag jetzt dieselbe Modellklasse mit geringerer Latenz bedient als der Launch-Snapshot. Wer auf dieses Datum pinnt, verzichtet auf diese Verbesserungen.

Pin-Muster

Das Muster, das sich gut bewährt hat:

  • Im Eval, in CI und in jedem compliance-auditierten Pfad pinnen.
  • Im Produktionsverkehr floaten.
  • Wöchentlich zwischen gepinnt und schwebend gegen einen festen Prompt-Set diffen, um Verhaltensdrift früh zu erkennen.

Speziell für den Launch-Snapshot vom Mai 2024 hinzuzufügen: einen dokumentierten Migrationsplan zu einem neueren 4o-Snapshot oder zur GPT-4.1-Familie haben, bevor das Deprecation-Datum eintrifft.

Für den breiteren 4o-Kontext siehe die schwebende GPT-4o-Seite. Für die neuere Familie, auf die die meisten neuen Builds abzielen sollten, siehe GPT-4.1.

Auswahl

Verwenden Sie gpt-4o-2024-05-13, wenn:

  • Sie ein spezifisches Ergebnis reproduzieren, das an das Launch-Modell gebunden ist.
  • Ein Compliance-Regime genau diesen Identifier genehmigt hat und eine erneute Genehmigung in Bearbeitung ist.
  • Ein Forschungs-Workflow das Referenzverhalten vom Mai 2024 erfordert.

Für alles andere wechseln Sie zu einem neueren Snapshot oder zum schwebenden Tag. Der Launch-Snapshot war ein Meilenstein; er ist nicht mehr die richtige Serving-Stufe.

Letzte technische Überprüfung: 2026-05-22 — Tokonomix.ai

gpt-4o-2024-05-13 — illustration 2

Anbieter-VergleichLIVE

Anbieter-Vergleich
Vergleiche jeden Anbieter dieses Modells — Preis, Qualität, Latenz und Uptime.
Azure OpenAI (EU - Sweden)EU
Eingabekostenbeste$3.58
Ausgabekosten$14.30
Qualitätbeste1106
Latenz (p50)Noch nicht getestet
UptimeNoch nicht getestet
Preise pro 1M Tokens über Tokonomix
OpenAIUSDieses Angebot
Eingabekosten$6.50
Ausgabekosten$19.50
Qualität1101
Latenz (p50)beste544 ms
UptimeNoch nicht getestet
Preise pro 1M Tokens über Tokonomix

Konsens-Intelligenz

MODELLWEIT

Konsens-Signale sind modellweit — noch nicht pro Anbieter getrennt.

8.0

Agent-Nutzen (1–10)

Präzisions-Score

0

Einzigartige Treffer

0

Validierte Anfragen

Schweregrad der Funde

Hoch 100%Mittel 0%Niedrig 0%

Community-StimmenLIVE

Community-Stimmen
Was echte Besucher denken — pro Anbieter.
Azure OpenAI (EU - Sweden)EU

Noch keine Community-Stimmen.

OpenAIUS

Noch keine Community-Stimmen.

Mehr Ergebnisse — pro Anbieter

Qualität nach Kategorie

CodegenerierungKreativFaktischMehrsprachigSchlussfolgernGesundheit

Spiel-Rubrik

Noch keine Daten.

Jury-Urteil

OK 94%Teilweise 5%Falsch 1%

Spiele & Arena

1

gespielt

0

Siege

1

Niederlagen

20.8 ± 7.2

TrueSkill (μ±σ)

Tempo & Gesundheit

544 ms

Latenz (p50)

Uptime

Frage & Antwort — durchblätternLIVE

1 von 81
🧠 IntelligenzOpenAIreasoning · 2026-09-13Score: 92

In een dorp wonen 100 mensen. 60 hebben een hond, 40 een kat, 20 hebben beide. Hoeveel mensen hebben geen huisdier? Toon je redenering.

Laten we de informatie systematisch analyseren om het aantal mensen zonder huisdier te bepalen. We hebben de volgende gegevens: - Aantal mensen met een hond (\(H\)): 60 - Aantal mensen met een kat (\(K\)): 40 - Aantal mensen met zowel een hond als een kat (\(B\)): 20 We moeten eerst het totale aantal mensen bepalen dat ten minste een hond of een kat heeft. Dit kunnen we doen met behulp van de formule van de vereniging van twee verzamelingen (in dit geval de mensen met honden en/of katten): \[ |H \cup K| = |H| + |K| - |H \cap K| \] waarbij: - \( |H| \) het aantal mensen met een hond is, - \( |K| \) het aantal mensen met een kat is, - \( |H \cap K| \) het aantal mensen met zowel een hond als een kat is, - \( |H \cup K| \) het aantal mensen met minimaal één huisdier is. Laten we de waard

Test-Historie — alle AnbieterLIVE

Qualitätsscore im Zeitverlaufneueste 76
08-3009-13
Geschwindigkeit — p50-Latenz im Zeitverlaufneueste 556 ms
08-2909-14