İçeriğe geç
Seviye C — Uzman
Çalıştığı yer:USYapıldığı yer:United States
$15.00
çıktı · 1M token başına (maliyet bazı)
Maliyet
1,695 ms
Yanıt hızı
100 / 100
Zeka

Karar — özetLIVE

LIVE
şimdi · 2026-07-26

Quality decline and latency increase observed across core performance metrics

Quality score dropped 5 points Latency increased 43% Multilingual performance remains perfect Strong reasoning score at 99

This benchmark window reveals notable performance degradation for gpt-4o-2024-05-13 compared to the previous evaluation period. The overall quality score dropped from 98.3 to 93.4, representing a 5-point decline that affects the model's competitive positioning. Latency deteriorated significantly, with the median response time increasing 43% from 1235ms to 1766ms, which may impact user experience in interactive applications. Category performance shows mixed results. Multilingual capabilities remained excellent at 100, maintaining parity with previous performance. Reasoning scored impressively at 99, demonstrating strong logical capabilities. However, factual accuracy scored only 83, suggesting potential reliability concerns for knowledge-intensive tasks. Creative performance at 92 shows a slight decline from the previous 95. The absence of coding scores in the current window prevents direct comparison in this critical category, though it previously achieved a perfect 100. Users should be aware of the latency increase when deploying this model in time-sensitive applications. The quality score reduction, while keeping the model in high-performance territory, indicates some regression that may warrant monitoring. Organizations relying on factual accuracy should conduct additional validation given the lower score in this category.

Quality

93.4

Latency p50

1,766 ms

Test runs

5

1 / 14

Görsel ve açıklamaLIVE

OpenAI

gpt-4o-2024-05-13

Seviye C — Uzman

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-4o-2024-05-13, OpenAI tarafından geliştirilen ve Mayıs 2024'te yayımlanan büyük bir çok modlu dil modelidir. Bu model, OpenAI'ın GPT-4o serisinin ilk sürümünü temsil eder; "o" ibaresi, hem metin hem de çok modlu girdiler için yapılan optimizasyona işaret etmektedir. Konuşma, içerik üretimi, analiz, kodlama desteği ve farklı alanlarda akıl yürütme dahil olmak üzere genel amaçlı metin üretim görevleri için tasarlanmıştır. Model, metin girdisini işleyip metin çıktısı üretir ve birden fazla dili ile teknik konuları kapsayan yeteneklere sahiptir. Bu sürüm, GPT-4o mimarisinin ilk üretim sürümü olarak görev yapar ve performans ile erişilebilirliği dengeleyen standart metin üretim yetenekleri sunar. Belirli mimari ayrıntılar tescilli kalmakla birlikte, model önceki GPT-4 türevlerinin oluşturduğu temele dayanır ve verimliliği ile yanıt kalitesini artırmaya yönelik mimari iyileştirmeler getirir. Uzun konuşmaları ve karmaşık talimatları desteklediğinden, basit soru-yanıt uygulamalarından ileri düzey analitik görevlere kadar geniş bir yelpazede kullanıma uygundur. OpenAI'ın model yelpazesinde GPT-4o-2024-05-13, amiral gemisi genel amaçlı bir model olarak merkezi bir konum tutar. OpenAI'ın sunduğu diğer GPT-4 türevlerinin yanında yer alır; daha önceki GPT-4 sürümlerine ve daha kompakt GPT-3.5 serisine alternatif oluşturur. Model, alana özgü ya da deneysel türevlerin uzmanlaşmış özelliklerine ihtiyaç duymaksızın ileri düzey dil anlama ve üretim yeteneği arayan kullanıcılar için konumlandırılmıştır. Bu anlık görüntü, modelin Mayıs 2024 yayım tarihindeki durumunu yansıtır.

OpenAI'nin kapsamlı eğitim verisi bu modelin geniş alan bilgisini destekliyor.

Tokonomix benchmark özeti

Yetenekler

toolssource: litellmvisionpdf inputparallel toolsprompt cachingmax output tokens: 4096
gpt-4o-2024-05-13 — illustration 1
gpt-4o-2024-05-13: lansman anlık görüntüsü

gpt-4o-2024-05-13, GPT-4o'nun orijinal sürümüdür ve modelin 13 Mayıs 2024'teki ilk kamuya açık erişim anında dondurulmuştur. OpenAI'nin birinci nesil multimodal modeline ait tarihli pin'dir — birleşik metin-görüntü-ses davranışını tanıtan ve sektörün bir öncü model yüzeyinden beklediği eşiği yeniden belirleyen sürümdür.

Çoğu ekip için bu anlık görüntü artık önerilemeyecek kadar eskidir. Lansman modeline karşı tekrarlanabilirliğin, sonraki herhangi bir iyileştirmeden daha önemli olduğu dar bir kullanım yelpazesi için ise hâlâ kullanılabilir durumdadır.

Bu kesin tarih neden önemli

13 Mayıs 2024 lansmanı, multimodalın bir araştırma demosu olmaktan çıkıp bir dağıtım hedefine dönüştüğü andı. Önceki GPT-4 varyantları görüntü desteğine sahipti, ancak ses yüzeyi ve metin üzerindeki düşük gecikme 4o'nun katkısıydı. Lansman modeline karşı eval dosyalayan ya da satıcı sözleşmesi yazan ekipler sabit bir referans noktası ister; bu anlık görüntü tam olarak o referans noktasıdır.

Bu kesin tarihi önemsemek için iki belirgin neden var.

Birincisi, karşılaştırma çalışmaları. Nesiller arasında model yeteneklerini yazan araştırma ekipleri, deneylerinin altından sessizce değişmemiş bir modele ihtiyaç duyar. Lansman anlık görüntüsü, orijinal OpenAI sürüm notlarında ve 2024 ortasındaki üçüncü taraf değerlendirme çalışmalarının çoğunda puanlanmış olan modeldir.

İkincisi, lansman modeline karşı onaylanmış düzenlemeye tabi dağıtımlar. Bazı uyumluluk rejimleri, üretim verilerine dokunan herhangi bir modelin belirli bir eval döngüsünden geçmiş olmasını gerektirir. Denetçiniz Mayıs 2024 sürümünü onayladıysa ve daha yeni bir anlık görüntüye geçiş henüz inceleme aşamasında değilse, çalıştırdığınız model budur.

Bu anlık görüntüde yer alanlar

OpenAI'nin lansman günü gönderdiği her şey. 128k token bağlam penceresiyle metin ve görüntü girişi. Dönemin uç noktaları üzerinden ses yüzeyleri. JSON modu, ancak sonradan eklenen yapılandırılmış çıktılar özelliği yok — o özellik 6 Ağustos 2024 sürümüyle geldi. Fonksiyon çağırma. Akış. Chat Completions yüzeyi; Responses yüzeyi daha sonra eklendi ve bu anlık görüntünün davranışının parçası değildir.

Bu anlık görüntüde yer almayan şey, sonraki 4o sürümlerinde gelen her şeydir. 6 Ağustos güncellemesi sıkı yapılandırılmış çıktılar ekledi ve JSON modu davranışını sıkılaştırdı. 20 Kasım güncellemesi akıl yürütme ve yazım kalitesi iyileştirmeleri getirdi. Bunların hiçbiri Mayıs anlık görüntüsünde yoktur. Aşağı akış işlem hattınız belirli bir yapılandırılmış çıktı davranışına bağlıysa, Mayıs pin'inin doğru tercih olduğunu varsaymadan önce hangi anlık görüntüye karşı inşa edildiğini doğrulayın.

Kullanımdan kaldırma riski

Bu, hâlâ rutin olarak erişilebilen en eski 4o anlık görüntüsüdür, yani sunset tarihine en yakın olanıdır. OpenAI'nin tarihli anlık görüntüler için tipik kullanımdan kaldırma ufku, sürümden itibaren on iki ila on sekiz ay arasındadır. Mayıs 2024 lansman modeli, bu pencerenin erken ucunu çoktan geçmiştir.

Geçişi aktif olarak planlayın. "Anlık görüntü bugün hâlâ yanıt veriyor" olmasının yarın da yanıt vereceğinin garantisi olmadığını unutmayın. Takvim hatırlatıcısı kurun, gpt-4o-2024-11-20'ye ya da kayan gpt-4o etiketine karşı yeniden eval çalıştırarak davranışsal farkı temel hatta oturtun ve geçişi, kullanımdan kaldırma tarihi duyurulduktan sonra değil önce kullanıma hazır hale getirin.

Kullanımdan kaldırma e-postasını bekleyen ekipler genellikle üretim işlem hatlarının, daha yeni anlık görüntülerin sessizce değiştirdiği belirli bir lansman anlık görüntüsü davranışına bağımlı olduğunu keşfeder. Geçiş çalışması, zaman baskısı altında yapıldığında çok daha pahalıdır.

Bu anlık görüntü ile sonraki anlık görüntüler arasında değişen şeyler

Lansman pin'inde kalıp kalmamaya ya da ileri taşınmaya karar veriyorsanız, bilinmesi gereken davranışsal farklar.

Yapılandırılmış çıktılar. Mayıs anlık görüntüsü JSON modunu destekler ancak şemaları Ağustos sürümü kadar katı bir şekilde uygulamaz. Şema doğrulamasına dayanan aşağı akış ayrıştırıcılar, bu anlık görüntüye karşı daha sık başarısız olabilir.

Reddetme kalibrasyonu. Lansman modeli, belirli reddetme örüntülerinde sonraki anlık görüntülere kıyasla daha agresiftir. Burada reddedilen bazı meşru istemler, Kasım sürümünde sorunsuz geçer.

Akıl yürütme. Kasım anlık görüntüsü, çok adımlı istemlerde gözle görülür biçimde daha güçlüdür. Akıl yürütme kalitesini test eden iş yükleri için aradaki fark belirgindir.

Gecikme. 2024 boyunca yapılan çıkarım yığınındaki iyileştirmeler, kayan etiketin artık aynı model sınıfını lansman anlık görüntüsünden daha düşük gecikmeyle sunduğu anlamına gelir. Bu tarihe pin'lemek, söz konusu iyileştirmelerin dışında kalmak demektir.

Pin örüntüsü

İyi yaşlanan örüntü:

  • Eval, CI ve denetimden geçen tüm uyumluluk yolları için pin'leyin.
  • Üretim trafiğinde kayan etiketi kullanın.
  • Davranışsal kaymayı erken yakalamak için pin'li ve kayan sürümleri sabit bir istem kümesine karşı haftalık olarak karşılaştırın.

Özellikle Mayıs 2024 lansman anlık görüntüsü için şunu ekleyin: kullanımdan kaldırma tarihi gelmeden önce daha yeni bir 4o anlık görüntüsüne ya da GPT-4.1 ailesine geçiş için belgelenmiş bir geçiş planınız olsun.

Daha geniş 4o bağlamı için kayan GPT-4o sayfasına bakın. Çoğu yeni yapının hedeflemesi gereken daha yeni aile için GPT-4.1 sayfasına bakın.

Seçim

gpt-4o-2024-05-13'ü şu durumlarda kullanın:

  • Lansman modeline bağlı belirli bir sonucu yeniden üretiyorsanız.
  • Bir uyumluluk rejimi tam olarak bu tanımlayıcıyı onayladıysa ve yeniden onay süreci devam ediyorsa.
  • Bir araştırma iş akışı Mayıs 2024 referans davranışını gerektiriyorsa.

Diğer her şey için daha yeni bir anlık görüntüye ya da kayan etikete geçin. Lansman anlık görüntüsü bir kilometre taşıydı; artık doğru hizmet katmanı değil.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-4o-2024-05-13 — illustration 2

Sağlayıcı karşılaştırmasıLIVE

Sağlayıcı karşılaştırması
Bu modeli sunan her sağlayıcıyı karşılaştırın — maliyet temeli, kalite, gecikme ve çalışma süresi.
Azure OpenAI (EU - Sweden)AB
Girdi maliyetien iyi$2.75
Çıktı maliyeti$11.00
KaliteHenüz test edilmedi
Gecikme (p50)Henüz test edilmedi
Çalışma süresiHenüz test edilmedi
Maliyetler 1M token başına (maliyet temeli)
OpenAIABDBu sunum
Girdi maliyeti$5.00
Çıktı maliyeti$15.00
Kaliteen iyi100.0
Gecikme (p50)en iyi1,695 ms
Çalışma süresiHenüz test edilmedi
Maliyetler 1M token başına (maliyet temeli)

Konsensüs zekâsı

MODEL GENELİ

Konsensüs sinyalleri model geneli — henüz sağlayıcı başına ayrılmadı.

8.0

Ajan faydası (1–10)

Hassasiyet puanı

0

Benzersiz tespitler

0

Doğrulanmış istekler

Bulgu ciddiyeti

Yüksek 100%Orta 0%Düşük 0%

Topluluk oylarıLIVE

Topluluk oyları
Gerçek ziyaretçiler ne düşünüyor — sağlayıcı başına.
Azure OpenAI (EU - Sweden)AB

Henüz topluluk oyu yok.

OpenAIABD

Henüz topluluk oyu yok.

Daha fazla sonuç — sağlayıcı başına

Kategoriye göre kalite

YaratıcıOlgusalÇok dilliAkıl yürütme

Oyun değerlendirmesi

Henüz veri yok.

Jüri kararı

Tamam 94%Kısmi 6%Yanlış 0%

Oyunlar ve arena

1

oynanan

0

galibiyet

1

mağlubiyet

20.8 ± 7.2

TrueSkill (μ±σ)

Hız ve sağlık

1,695 ms

Gecikme (p50)

Çalışma süresi

Soru & cevap — göz atLIVE

1 / 81
🧠 zekâOpenAImultilingual · 2026-07-26puan: 100

Bir mağazada %20 indirim uygulanıyor. 150 TL olan bir ürün indirimden sonra kaç TL olur?

150 TL olan bir ürüne %20 indirim uygulandığında, önce indirimin ne kadar olduğunu hesaplamamız gerekiyor. %20 indirim, ürünün fiyatının %20'si kadardır. 150 TL'nin %20'si şu şekilde hesaplanır: \[ 150 \, \text{TL} \times \frac{20}{100} = 150 \, \text{TL} \times 0.20 = 30 \, \text{TL} \] İndirim tutarı 30 TL'dir. Bu tutarı 150 TL'den çıkardığımızda indirimli fiyatı buluruz: \[ 150 \, \text{TL} - 30 \, \text{TL} = 120 \, \text{TL} \] Dolayısıyla, 150 TL olan bir ürün indirimden sonra 120 TL olur.

Test geçmişi — tüm sağlayıcılarLIVE

Zaman içinde kalite puanıen son 93
05-1507-26
Hız — zaman içinde p50 gecikme

Bu model birkaç farklı günde test edildiğinde bir trend görünür.