İçeriğe geç
Seviye C — Uzman
Çalıştığı yer:USYapıldığı yer:United States
$13.00
çıktı · 1M token başına
Maliyet
617 ms
Yanıt hızı
1082
Zeka

Karar — özetLIVE

LIVE
şimdi · 2026-09-13

Strong reasoning performance offset by latency regression and factual gaps

Perfect reasoning score achieved Coding performance remains strong Latency increased 33 percent Factual accuracy concerns

The gpt-4o-2024-11-20 release maintains its overall quality score at 83.0, showing marginal improvement from the previous 82.3. The model demonstrates exceptional reasoning capabilities with a perfect score of 100, while coding performance remains consistently strong at 92 across both windows. However, the factual category reveals a concerning weakness at 57, representing a significant gap in the model's performance profile that wasn't visible in previous testing categories. Latency has degraded notably, with p50 response times increasing 33% from 1714ms to 2273ms. This represents a meaningful regression in user experience, particularly for interactive applications where response time matters. The slower performance appears alongside the benchmark suite testing different capability areas between windows, making it difficult to attribute whether the latency increase stems from model changes or different task complexity. The model continues to offer comprehensive multimodal capabilities with tool use and structured output support. Users should expect excellent performance on reasoning and coding tasks, but may encounter limitations with factual recall and information accuracy. The latency increase warrants consideration for time-sensitive applications.

Kalite

83.0

Gecikme p50

2,273 ms

Test çalıştırmaları

5

1 / 20

Görsel ve açıklamaLIVE

OpenAI

gpt-4o-2024-11-20

Seviye C — Uzman

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-4o-2024-11-20, OpenAI tarafından geliştirilen ve Kasım 2024'te GPT-4o serisinin bir parçası olarak yayımlanan büyük bir dil modelidir. Bu model, OpenAI'nin çok modlu mimarisinin bir iterasyonunu temsil etmekle birlikte, bu dağıtımda öncelikli olarak standart metin üretim görevleri için işlev görmektedir. İçerik oluşturma, soru yanıtlama, kod üretimi, analiz ve sohbet uygulamaları gibi görevler dahil olmak üzere genel amaçlı dil anlama ve üretme için tasarlanmıştır. Model, yanıt kalitesini, tutarlılığını ve talimat takip yeteneklerini iyileştirmeye yönelik düzenlemelerle GPT-4 mimarisi üzerine inşa edilmiştir. Parametre sayısı ve eğitim verisine ilişkin belirli teknik ayrıntılar OpenAI tarafından açıklanmamış olsa da, model sınır sınıfı dil modelleriyle tutarlı performans özellikleri sergilemektedir. Metin girdilerini işleyip metin çıktıları üretirken birden çok dili ve bilgi alanını kapsayan yeteneklere sahip olup eğitim verisi kesim tarihi 2023 ortasıdır. OpenAI'nin model yelpazesinde GPT-4o-2024-11-20, GPT-4o ailesinde standart bir seçenek olarak yer almakta; önceki GPT-4 modelleri ile OpenAI'nin daha yeni sürümleri arasında konumlanmaktadır. GPT-4o'daki "o" tanımı, pratik dağıtım senaryolarına yönelik optimizasyonları ifade eder. Bu belirli anlık görüntü, modelin Kasım 2024 yayım tarihindeki durumunu temsil etmekte olup bu yapılandırmada özelleşmiş çok modlu işleme gereksinimleri olmadan güvenilir metin üretimi gerektiren uygulamalar için OpenAI'nin önerilen genel amaçlı modeli olarak hizmet vermektedir.

OpenAI'nin kapsamlı eğitim verisi bu modelin geniş alan bilgisini destekliyor.

Tokonomix benchmark özeti

Yetenekler

toolssource: litellmvisionjson modepdf inputjson schemaparallel toolsprompt cachingmax output tokens: 16384
gpt-4o-2024-11-20 — illustration 1
gpt-4o-2024-11-20: 2024 sonu 4o anlık görüntüsü

gpt-4o-2024-11-20, OpenAI'nin GPT-4.1 ailesi gelmeden önceki son büyük GPT-4o anlık görüntüsüdür. 20 Kasım 2024'te yayımlanan bu sürüm, modeli olgun halinde temsil eder — lansman modeliyle aynı çok modlu yüzeye sahiptir; ancak 2024'ün ikinci yarısında devreye giren akıl yürütme, yazı kalitesi ve reddetme kalibrasyonu iyileştirmelerini barındırır.

Üretimde hâlâ 4o üzerinde çalışan ekipler için genellikle doğru sabitleme noktasıdır. Yeni yapımlarda ise konuşma çoktan başka yöne kaymıştır.

Kasım sürümünün getirdiği değişiklikler

Ağustos 2024 anlık görüntüsü, katı yapılandırılmış çıktıları getirdiği için yapısal ilginin büyük bölümünü topladı. Kasım sürümü ise daha sessiz bir değişiklikler bütünüydü, ancak üretimde en az onun kadar belirleyici oldu.

Akıl yürütme kalitesi. Kasım sürümü, çok adımlı istemlerde hem lansman modelinden hem de Ağustos anlık görüntüsünden gözle görülür biçimde daha güçlüdür. Düşünce zinciri tarzı çalışmalar, planlama istemleri, belirsiz bir spesifikasyondan özgün kod sentezleme — hepsinde ölçülebilir bir iyileşme görülür. Model, GPT-5 ailesinden gelen akıl yürütmeye özel ince ayarlanmış ardıllarının düzeyinde değildir, ancak 4o sınıfı için en yüksek noktayı temsil ediyordu.

Yazı kalitesi. Bu anlık görüntüden çıkan uzun biçimli düzyazı, Ağustos sürümünden belirgin biçimde daha az katıdır. Cümle yapısı daha çok çeşitlilik gösterir, istem gerektirmediğinde model daha az çekimser ifadeler kullanır ve paragraflar arasındaki üslup daha tutarlıdır. Blog taslakları, yönetici özetleri veya 4o üzerinde herhangi bir üretim metni üretimi yapan ekipler, yalnızca bu sebepten bile bu anlık görüntüye sabitleme eğilimindedir.

Reddetme kalibrasyonu. Sınırdaki istemlerde Ağustos sürümüne kıyasla biraz daha az agresiftir. Ağustos anlık görüntüsünün reddettiği bazı meşru uç durum istekleri, Kasım sürümünde sorunsuz şekilde geçer.

Anlık görüntüde neler yer alıyor

Kasım 2024'te bulunduğu hâliyle tam GPT-4o özellik yüzeyi. 128k token bağlam penceresiyle metin ve görsel girişi. Ses, realtime API ve aynı dönemdeki uç noktalar aracılığıyla sunulur. Ağustos sürümünden devralınan katı yapılandırılmış çıktılar. JSON modu. Fonksiyon çağırma. Chat Completions yüzeyinde akış desteği.

Bu anlık görüntüde olmayan şey ise GPT-4.1 ailesinden herhangi bir özelliktir. Bir milyon tokenlık bağlam, daha ileri akıl yürütme iyileştirmeleri, güncellenmiş tokenleştirici işleme — hepsi daha yeni ailede kalır. İş yükünüz bunlardan gerçekten yararlanıyorsa, yükseltme tartışması yalnızca anlık görüntü tarihi değil, model ailesi üzerinedir.

Ekipler neden özellikle Kasım'a sabitliyor

Bugün üretimdeki çoğu 4o sabitlemesi bu tarihe veya kayan etikete denk gelir. Nedenleri standart olanlardır.

Bu tanımlayıcıyı onaylamış uyum rejimleri. Kasım anlık görüntüsü, ona karşı tamamlanan denetim döngülerinin hâlâ geçerli olduğu kadar yenidir; bu da onu düzenlenmiş ortamlarda en çok onaylanan sabitlenmiş 4o sürümü yapar.

Kasım davranışına göre ayarlanmış aşağı akış işlem hatları. Bu anlık görüntünün yazı veya akıl yürütme kalitesi etrafında sistem kuran ekipler — içerik üretimi, özetleme hizmetleri, Kasım'ın belirli karar örüntülerine bağımlı ajan döngüleri — o davranışı kilitlemek için sabitleme yapar.

Geçişin ertelenmesi. GPT-4.1 veya GPT-5'e geçişi henüz tamamlamamış ekipler için Kasım'a sabitlemek, geçiş çalışması sürerken stabil bir hedef sunar. Geçiş sırasında üretimde kayan etiket kullanmak, değerlendirme raporlarında hareketli hedeflerin garantili reçetesidir.

Alanın bugünkü durumuyla karşılaştırma

Kasım anlık görüntüsündeki GPT-4o artık sınırın önünde değildir. GPT-4.1, GPT-5 ve Claude Opus 4.x ile Gemini 3 Pro aileleri; akıl yürütme, uzun bağlamlı çalışmalar ve yapılandırılmış çıktı uç durumlarında açıkça öndedir.

4o'nun hâlâ elinde tuttuğu şeyler ise iyi anlaşılmış bir dağıtım hikâyesi, sınır seviyesinden daha dostane bir fiyat noktası ve gpt-4o-audio ile realtime API üzerinden sunulan, üretim ses çalışmalarında hiçbir ardılın tam olarak yerini almadığı bir ses yüzeyidir.

Kategoriler arası karşılaştırma için bkz. /benchmarks/leaderboard. Hız ve zekâ dökümleri için /benchmarks/speed ve /benchmarks/intelligence.

Kullanımdan kaldırma riski

Bu anlık görüntü en güncel 4o sabitlemesidir ve dolayısıyla kullanımdan kaldırılmaya en uzak olanıdır, ancak deprecation ufku sonludur. OpenAI'nin tipik on iki ila on sekiz aylık döngüsü geçerlidir. Buna göre plan yapın.

4o ailesi tarafındaki doğal ardıl, Kasım'ın davranışının büyük bölümünü ve sonrasında devreye alınan küçük iyileştirmeleri taşıyan kayan etikettir. İleriye dönük hamle ise iş yüküne bağlı olarak GPT-4.1 veya GPT-5'e geçmektir. Kullanımdan kaldırma tarihi duyurulmadan önce değerlendirme döngüsünü hazır tutun.

Sabitleme örüntüsü

İşe yarayan örüntü:

  • Değerlendirmede, CI'de ve denetlenen iş akışlarında sabitleyin.
  • Üretim trafiğinde, devam eden küçük iyileştirmelerin yeniden üretilebilirlikten daha değerli olduğu yerlerde kayan etiket kullanın.
  • Davranışsal sapmayı yakalamak için sabit bir istem kümesine karşı, sabitlenmiş ile kayan sürüm arasında haftalık farklılaştırma yapın.

Özellikle Kasım için, kayan etiketin bu anlık görüntüden uzaklaşması bugün hâlâ yeterince küçüktür ve fark çalışması çoğu zaman temiz döner. Bu, zamanla değişir; fark işini takvimden düşürmeyin.

Kayan 4o yüzeyi için bkz. GPT-4o. Yeni yapımlarda 4o'nun yerini alan aile için bkz. GPT-4.1.

Seçim kriteri

gpt-4o-2024-11-20'yi şu durumlarda kullanın:

  • Bir uyum rejimi bu tanımlayıcıyı onayladıysa ve bu en son denetim döngünüzse.
  • Aşağı akış işlem hatları bu spesifik sürümün yazı veya akıl yürütme kalitesine bağımlıysa.
  • Üretimde 4o çalıştırıyorsanız ve GPT-4.1'e geçiş devam ederken stabil bir sabitleme noktası istiyorsanız.

Yeni yapımlar için daha yeni aileyi hedefleyin. Kasım, inilecek iyi bir noktaydı. Artık sıranın başında değil.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-4o-2024-11-20 — illustration 2

Sağlayıcı karşılaştırmasıLIVE

Sağlayıcı karşılaştırması
Bu modeli sunan her sağlayıcıyı karşılaştırın — fiyat, kalite, gecikme ve çalışma süresi.
Azure OpenAI (EU - Sweden)AB
Girdi maliyeti$3.58
Çıktı maliyeti$14.30
Kaliteen iyi1106
Gecikme (p50)Henüz test edilmedi
Çalışma süresiHenüz test edilmedi
Tokonomix üzerinde 1M token başına fiyatlar
OpenAIABDBu sunum
Girdi maliyetien iyi$3.25
Çıktı maliyeti$13.00
Kalite1082
Gecikme (p50)en iyi617 ms
Çalışma süresiHenüz test edilmedi
Tokonomix üzerinde 1M token başına fiyatlar

Konsensüs zekâsı

MODEL GENELİ

Konsensüs sinyalleri model geneli — henüz sağlayıcı başına ayrılmadı.

8.0

Ajan faydası (1–10)

Hassasiyet puanı

0

Benzersiz tespitler

0

Doğrulanmış istekler

Bulgu ciddiyeti

Yüksek 100%Orta 0%Düşük 0%

Topluluk oylarıLIVE

Topluluk oyları
Gerçek ziyaretçiler ne düşünüyor — sağlayıcı başına.
Azure OpenAI (EU - Sweden)AB

Henüz topluluk oyu yok.

OpenAIABD

Henüz topluluk oyu yok.

Daha fazla sonuç — sağlayıcı başına

Kategoriye göre kalite

Kod üretimiYaratıcıOlgusalÇok dilliAkıl yürütmeSağlık

Oyun değerlendirmesi

Henüz veri yok.

Jüri kararı

Tamam 93%Kısmi 5%Yanlış 2%

Oyunlar ve arena

Henüz veri yok.

Hız ve sağlık

617 ms

Gecikme (p50)

Çalışma süresi

Soru & cevap — göz atLIVE

1 / 80
🧠 zekâOpenAIreasoning · 2026-09-13puan: 100

In een dorp wonen 100 mensen. 60 hebben een hond, 40 een kat, 20 hebben beide. Hoeveel mensen hebben geen huisdier? Toon je redenering.

We willen bepalen hoeveel mensen in dit dorp geen huisdier hebben. Laten we dit probleem stap voor stap oplossen: 1. **Aantal mensen dat een hond heeft**: Dit zijn 60 mensen. 2. **Aantal mensen dat een kat heeft**: Dit zijn 40 mensen. 3. **Aantal mensen dat **beide** heeft**: Dit zijn 20 mensen. 4. **Overlap corrigeren (dubbele telling)**: De 20 mensen die **zowel een hond als een kat** hebben, worden dubbel geteld in de aantallen van hondenbezitters (60) en kattenbezitters (40). Daarom moeten we deze overlap aftrekken om het juiste aantal unieke huisdierbezitters te berekenen. Het totale aantal unieke huisdierbezitters is: \[ (60 + 40 - 20) = 80 \] Dus er zijn 80 mensen die **ten minste één huisdier** hebben. 5. **Aantal mensen zonder huisdier**:

Test geçmişi — tüm sağlayıcılarLIVE

Zaman içinde kalite puanıen son 80
08-3009-13
Hız — zaman içinde p50 gecikmeen son 578 ms
08-2909-14