İçeriğe geç
Seviye C — Uzman

Kullanımdan kaldırma tarihi

Sağlayıcı bu modeli 23 Ekim 2026 tarihinde kullanımdan kaldıracak. O zamana kadar her zamanki gibi çalışır.

Çalıştığı yer:USYapıldığı yer:United States
$19.50
çıktı · 1M token başına
Maliyet
544 ms
Yanıt hızı
1101
Zeka

Karar — özetLIVE

LIVE
şimdi · 2026-09-13

Quality drops 15.7 points with factual performance decline

Quality dropped 15.7 points Factual performance fell to 53 Coding remains stable at 92 Latency increased 9 percent

The gpt-4o-2024-05-13 model experienced a significant quality decline in the current benchmark window, dropping from 94.7 to 79.0 overall. This 15.7 point decrease represents a notable regression from the previous period's strong performance. The most dramatic change appears in category scoring, where factual performance plummeted to 53 points compared to the previous window's scores. While coding performance remained stable at 92 across both windows, demonstrating consistency in this critical domain, the absence of multilingual and creative category scores in the current window makes direct comparison incomplete. Reasoning performance at 92 shows the model maintains strong logical capabilities. Latency increased modestly from 1538ms to 1679ms at the median, representing a 9 percent slowdown that may impact user experience in latency-sensitive applications. The factual category weakness is particularly concerning given its importance for information retrieval and knowledge-based tasks. Users relying on this model for factual accuracy should exercise additional verification, while those prioritizing coding and reasoning tasks will find performance remains robust. The quality regression warrants attention to determine whether this represents a temporary anomaly or systematic issue.

Kalite

79.0

Gecikme p50

1,679 ms

Test çalıştırmaları

5

1 / 20

Görsel ve açıklamaLIVE

OpenAI

gpt-4o-2024-05-13

Seviye C — Uzman

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-4o-2024-05-13, OpenAI tarafından geliştirilen ve Mayıs 2024'te yayımlanan büyük bir çok modlu dil modelidir. Bu model, OpenAI'ın GPT-4o serisinin ilk sürümünü temsil eder; "o" ibaresi, hem metin hem de çok modlu girdiler için yapılan optimizasyona işaret etmektedir. Konuşma, içerik üretimi, analiz, kodlama desteği ve farklı alanlarda akıl yürütme dahil olmak üzere genel amaçlı metin üretim görevleri için tasarlanmıştır. Model, metin girdisini işleyip metin çıktısı üretir ve birden fazla dili ile teknik konuları kapsayan yeteneklere sahiptir. Bu sürüm, GPT-4o mimarisinin ilk üretim sürümü olarak görev yapar ve performans ile erişilebilirliği dengeleyen standart metin üretim yetenekleri sunar. Belirli mimari ayrıntılar tescilli kalmakla birlikte, model önceki GPT-4 türevlerinin oluşturduğu temele dayanır ve verimliliği ile yanıt kalitesini artırmaya yönelik mimari iyileştirmeler getirir. Uzun konuşmaları ve karmaşık talimatları desteklediğinden, basit soru-yanıt uygulamalarından ileri düzey analitik görevlere kadar geniş bir yelpazede kullanıma uygundur. OpenAI'ın model yelpazesinde GPT-4o-2024-05-13, amiral gemisi genel amaçlı bir model olarak merkezi bir konum tutar. OpenAI'ın sunduğu diğer GPT-4 türevlerinin yanında yer alır; daha önceki GPT-4 sürümlerine ve daha kompakt GPT-3.5 serisine alternatif oluşturur. Model, alana özgü ya da deneysel türevlerin uzmanlaşmış özelliklerine ihtiyaç duymaksızın ileri düzey dil anlama ve üretim yeteneği arayan kullanıcılar için konumlandırılmıştır. Bu anlık görüntü, modelin Mayıs 2024 yayım tarihindeki durumunu yansıtır.

OpenAI'nin kapsamlı eğitim verisi bu modelin geniş alan bilgisini destekliyor.

Tokonomix benchmark özeti

Yetenekler

toolssource: litellmvisionpdf inputparallel toolsprompt cachingmax output tokens: 4096
gpt-4o-2024-05-13 — illustration 1
gpt-4o-2024-05-13: lansman anlık görüntüsü

gpt-4o-2024-05-13, GPT-4o'nun orijinal sürümüdür ve modelin 13 Mayıs 2024'teki ilk kamuya açık erişim anında dondurulmuştur. OpenAI'nin birinci nesil multimodal modeline ait tarihli pin'dir — birleşik metin-görüntü-ses davranışını tanıtan ve sektörün bir öncü model yüzeyinden beklediği eşiği yeniden belirleyen sürümdür.

Çoğu ekip için bu anlık görüntü artık önerilemeyecek kadar eskidir. Lansman modeline karşı tekrarlanabilirliğin, sonraki herhangi bir iyileştirmeden daha önemli olduğu dar bir kullanım yelpazesi için ise hâlâ kullanılabilir durumdadır.

Bu kesin tarih neden önemli

13 Mayıs 2024 lansmanı, multimodalın bir araştırma demosu olmaktan çıkıp bir dağıtım hedefine dönüştüğü andı. Önceki GPT-4 varyantları görüntü desteğine sahipti, ancak ses yüzeyi ve metin üzerindeki düşük gecikme 4o'nun katkısıydı. Lansman modeline karşı eval dosyalayan ya da satıcı sözleşmesi yazan ekipler sabit bir referans noktası ister; bu anlık görüntü tam olarak o referans noktasıdır.

Bu kesin tarihi önemsemek için iki belirgin neden var.

Birincisi, karşılaştırma çalışmaları. Nesiller arasında model yeteneklerini yazan araştırma ekipleri, deneylerinin altından sessizce değişmemiş bir modele ihtiyaç duyar. Lansman anlık görüntüsü, orijinal OpenAI sürüm notlarında ve 2024 ortasındaki üçüncü taraf değerlendirme çalışmalarının çoğunda puanlanmış olan modeldir.

İkincisi, lansman modeline karşı onaylanmış düzenlemeye tabi dağıtımlar. Bazı uyumluluk rejimleri, üretim verilerine dokunan herhangi bir modelin belirli bir eval döngüsünden geçmiş olmasını gerektirir. Denetçiniz Mayıs 2024 sürümünü onayladıysa ve daha yeni bir anlık görüntüye geçiş henüz inceleme aşamasında değilse, çalıştırdığınız model budur.

Bu anlık görüntüde yer alanlar

OpenAI'nin lansman günü gönderdiği her şey. 128k token bağlam penceresiyle metin ve görüntü girişi. Dönemin uç noktaları üzerinden ses yüzeyleri. JSON modu, ancak sonradan eklenen yapılandırılmış çıktılar özelliği yok — o özellik 6 Ağustos 2024 sürümüyle geldi. Fonksiyon çağırma. Akış. Chat Completions yüzeyi; Responses yüzeyi daha sonra eklendi ve bu anlık görüntünün davranışının parçası değildir.

Bu anlık görüntüde yer almayan şey, sonraki 4o sürümlerinde gelen her şeydir. 6 Ağustos güncellemesi sıkı yapılandırılmış çıktılar ekledi ve JSON modu davranışını sıkılaştırdı. 20 Kasım güncellemesi akıl yürütme ve yazım kalitesi iyileştirmeleri getirdi. Bunların hiçbiri Mayıs anlık görüntüsünde yoktur. Aşağı akış işlem hattınız belirli bir yapılandırılmış çıktı davranışına bağlıysa, Mayıs pin'inin doğru tercih olduğunu varsaymadan önce hangi anlık görüntüye karşı inşa edildiğini doğrulayın.

Kullanımdan kaldırma riski

Bu, hâlâ rutin olarak erişilebilen en eski 4o anlık görüntüsüdür, yani sunset tarihine en yakın olanıdır. OpenAI'nin tarihli anlık görüntüler için tipik kullanımdan kaldırma ufku, sürümden itibaren on iki ila on sekiz ay arasındadır. Mayıs 2024 lansman modeli, bu pencerenin erken ucunu çoktan geçmiştir.

Geçişi aktif olarak planlayın. "Anlık görüntü bugün hâlâ yanıt veriyor" olmasının yarın da yanıt vereceğinin garantisi olmadığını unutmayın. Takvim hatırlatıcısı kurun, gpt-4o-2024-11-20'ye ya da kayan gpt-4o etiketine karşı yeniden eval çalıştırarak davranışsal farkı temel hatta oturtun ve geçişi, kullanımdan kaldırma tarihi duyurulduktan sonra değil önce kullanıma hazır hale getirin.

Kullanımdan kaldırma e-postasını bekleyen ekipler genellikle üretim işlem hatlarının, daha yeni anlık görüntülerin sessizce değiştirdiği belirli bir lansman anlık görüntüsü davranışına bağımlı olduğunu keşfeder. Geçiş çalışması, zaman baskısı altında yapıldığında çok daha pahalıdır.

Bu anlık görüntü ile sonraki anlık görüntüler arasında değişen şeyler

Lansman pin'inde kalıp kalmamaya ya da ileri taşınmaya karar veriyorsanız, bilinmesi gereken davranışsal farklar.

Yapılandırılmış çıktılar. Mayıs anlık görüntüsü JSON modunu destekler ancak şemaları Ağustos sürümü kadar katı bir şekilde uygulamaz. Şema doğrulamasına dayanan aşağı akış ayrıştırıcılar, bu anlık görüntüye karşı daha sık başarısız olabilir.

Reddetme kalibrasyonu. Lansman modeli, belirli reddetme örüntülerinde sonraki anlık görüntülere kıyasla daha agresiftir. Burada reddedilen bazı meşru istemler, Kasım sürümünde sorunsuz geçer.

Akıl yürütme. Kasım anlık görüntüsü, çok adımlı istemlerde gözle görülür biçimde daha güçlüdür. Akıl yürütme kalitesini test eden iş yükleri için aradaki fark belirgindir.

Gecikme. 2024 boyunca yapılan çıkarım yığınındaki iyileştirmeler, kayan etiketin artık aynı model sınıfını lansman anlık görüntüsünden daha düşük gecikmeyle sunduğu anlamına gelir. Bu tarihe pin'lemek, söz konusu iyileştirmelerin dışında kalmak demektir.

Pin örüntüsü

İyi yaşlanan örüntü:

  • Eval, CI ve denetimden geçen tüm uyumluluk yolları için pin'leyin.
  • Üretim trafiğinde kayan etiketi kullanın.
  • Davranışsal kaymayı erken yakalamak için pin'li ve kayan sürümleri sabit bir istem kümesine karşı haftalık olarak karşılaştırın.

Özellikle Mayıs 2024 lansman anlık görüntüsü için şunu ekleyin: kullanımdan kaldırma tarihi gelmeden önce daha yeni bir 4o anlık görüntüsüne ya da GPT-4.1 ailesine geçiş için belgelenmiş bir geçiş planınız olsun.

Daha geniş 4o bağlamı için kayan GPT-4o sayfasına bakın. Çoğu yeni yapının hedeflemesi gereken daha yeni aile için GPT-4.1 sayfasına bakın.

Seçim

gpt-4o-2024-05-13'ü şu durumlarda kullanın:

  • Lansman modeline bağlı belirli bir sonucu yeniden üretiyorsanız.
  • Bir uyumluluk rejimi tam olarak bu tanımlayıcıyı onayladıysa ve yeniden onay süreci devam ediyorsa.
  • Bir araştırma iş akışı Mayıs 2024 referans davranışını gerektiriyorsa.

Diğer her şey için daha yeni bir anlık görüntüye ya da kayan etikete geçin. Lansman anlık görüntüsü bir kilometre taşıydı; artık doğru hizmet katmanı değil.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-4o-2024-05-13 — illustration 2

Sağlayıcı karşılaştırmasıLIVE

Sağlayıcı karşılaştırması
Bu modeli sunan her sağlayıcıyı karşılaştırın — fiyat, kalite, gecikme ve çalışma süresi.
Azure OpenAI (EU - Sweden)AB
Girdi maliyetien iyi$3.58
Çıktı maliyeti$14.30
Kaliteen iyi1106
Gecikme (p50)Henüz test edilmedi
Çalışma süresiHenüz test edilmedi
Tokonomix üzerinde 1M token başına fiyatlar
OpenAIABDBu sunum
Girdi maliyeti$6.50
Çıktı maliyeti$19.50
Kalite1101
Gecikme (p50)en iyi544 ms
Çalışma süresiHenüz test edilmedi
Tokonomix üzerinde 1M token başına fiyatlar

Konsensüs zekâsı

MODEL GENELİ

Konsensüs sinyalleri model geneli — henüz sağlayıcı başına ayrılmadı.

8.0

Ajan faydası (1–10)

Hassasiyet puanı

0

Benzersiz tespitler

0

Doğrulanmış istekler

Bulgu ciddiyeti

Yüksek 100%Orta 0%Düşük 0%

Topluluk oylarıLIVE

Topluluk oyları
Gerçek ziyaretçiler ne düşünüyor — sağlayıcı başına.
Azure OpenAI (EU - Sweden)AB

Henüz topluluk oyu yok.

OpenAIABD

Henüz topluluk oyu yok.

Daha fazla sonuç — sağlayıcı başına

Kategoriye göre kalite

Kod üretimiYaratıcıOlgusalÇok dilliAkıl yürütmeSağlık

Oyun değerlendirmesi

Henüz veri yok.

Jüri kararı

Tamam 94%Kısmi 5%Yanlış 1%

Oyunlar ve arena

1

oynanan

0

galibiyet

1

mağlubiyet

20.8 ± 7.2

TrueSkill (μ±σ)

Hız ve sağlık

544 ms

Gecikme (p50)

Çalışma süresi

Soru & cevap — göz atLIVE

1 / 81
🧠 zekâOpenAIreasoning · 2026-09-13puan: 92

In een dorp wonen 100 mensen. 60 hebben een hond, 40 een kat, 20 hebben beide. Hoeveel mensen hebben geen huisdier? Toon je redenering.

Laten we de informatie systematisch analyseren om het aantal mensen zonder huisdier te bepalen. We hebben de volgende gegevens: - Aantal mensen met een hond (\(H\)): 60 - Aantal mensen met een kat (\(K\)): 40 - Aantal mensen met zowel een hond als een kat (\(B\)): 20 We moeten eerst het totale aantal mensen bepalen dat ten minste een hond of een kat heeft. Dit kunnen we doen met behulp van de formule van de vereniging van twee verzamelingen (in dit geval de mensen met honden en/of katten): \[ |H \cup K| = |H| + |K| - |H \cap K| \] waarbij: - \( |H| \) het aantal mensen met een hond is, - \( |K| \) het aantal mensen met een kat is, - \( |H \cap K| \) het aantal mensen met zowel een hond als een kat is, - \( |H \cup K| \) het aantal mensen met minimaal één huisdier is. Laten we de waard

Test geçmişi — tüm sağlayıcılarLIVE

Zaman içinde kalite puanıen son 76
08-3009-13
Hız — zaman içinde p50 gecikmeen son 556 ms
08-2909-14