İçeriğe geç
Seviye C — Uzman
Çalıştığı yer:USYapıldığı yer:United States
$10.00
çıktı · 1M token başına (maliyet bazı)
Maliyet
1,003 ms
Yanıt hızı
100 / 100
Zeka

Karar — özetLIVE

LIVE
şimdi · 2026-07-26

Quality decline and slower responses across tested categories

Quality dropped 6.8 points Latency increased 46% Multilingual remains at 100 Creative performance declined

This benchmark window reveals a significant performance regression for gpt-4o-2024-11-20. Overall quality dropped 6.8 points from 99.3 to 92.5, while latency increased by 46% with median response times rising from 1253ms to 1825ms. The category composition changed between windows, making direct comparisons limited, but the available data shows mixed results. Multilingual capabilities remained exceptional at 100 in both windows, demonstrating consistent strength in language handling. However, creative tasks scored 87 compared to the previous 98, indicating a notable decline in this area. Reasoning achieved a perfect 100 score, while factual performance registered at 83. The previous window's perfect coding score of 100 cannot be compared as coding was not tested in the current window. The substantial latency increase is particularly concerning for real-time applications, representing nearly half a second of additional wait time per request. Users should be aware that this version shows reduced creative capability and slower response times compared to the previous benchmark period, though multilingual and reasoning performance remain strong areas.

Quality

92.5

Latency p50

1,825 ms

Test runs

5

1 / 15

Görsel ve açıklamaLIVE

OpenAI

gpt-4o-2024-11-20

Seviye C — Uzman

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-4o-2024-11-20, OpenAI tarafından geliştirilen ve Kasım 2024'te GPT-4o serisinin bir parçası olarak yayımlanan büyük bir dil modelidir. Bu model, OpenAI'nin çok modlu mimarisinin bir iterasyonunu temsil etmekle birlikte, bu dağıtımda öncelikli olarak standart metin üretim görevleri için işlev görmektedir. İçerik oluşturma, soru yanıtlama, kod üretimi, analiz ve sohbet uygulamaları gibi görevler dahil olmak üzere genel amaçlı dil anlama ve üretme için tasarlanmıştır. Model, yanıt kalitesini, tutarlılığını ve talimat takip yeteneklerini iyileştirmeye yönelik düzenlemelerle GPT-4 mimarisi üzerine inşa edilmiştir. Parametre sayısı ve eğitim verisine ilişkin belirli teknik ayrıntılar OpenAI tarafından açıklanmamış olsa da, model sınır sınıfı dil modelleriyle tutarlı performans özellikleri sergilemektedir. Metin girdilerini işleyip metin çıktıları üretirken birden çok dili ve bilgi alanını kapsayan yeteneklere sahip olup eğitim verisi kesim tarihi 2023 ortasıdır. OpenAI'nin model yelpazesinde GPT-4o-2024-11-20, GPT-4o ailesinde standart bir seçenek olarak yer almakta; önceki GPT-4 modelleri ile OpenAI'nin daha yeni sürümleri arasında konumlanmaktadır. GPT-4o'daki "o" tanımı, pratik dağıtım senaryolarına yönelik optimizasyonları ifade eder. Bu belirli anlık görüntü, modelin Kasım 2024 yayım tarihindeki durumunu temsil etmekte olup bu yapılandırmada özelleşmiş çok modlu işleme gereksinimleri olmadan güvenilir metin üretimi gerektiren uygulamalar için OpenAI'nin önerilen genel amaçlı modeli olarak hizmet vermektedir.

OpenAI'nin kapsamlı eğitim verisi bu modelin geniş alan bilgisini destekliyor.

Tokonomix benchmark özeti

Yetenekler

toolssource: litellmvisionjson modepdf inputjson schemaparallel toolsprompt cachingmax output tokens: 16384
gpt-4o-2024-11-20 — illustration 1
gpt-4o-2024-11-20: 2024 sonu 4o anlık görüntüsü

gpt-4o-2024-11-20, OpenAI'nin GPT-4.1 ailesi gelmeden önceki son büyük GPT-4o anlık görüntüsüdür. 20 Kasım 2024'te yayımlanan bu sürüm, modeli olgun halinde temsil eder — lansman modeliyle aynı çok modlu yüzeye sahiptir; ancak 2024'ün ikinci yarısında devreye giren akıl yürütme, yazı kalitesi ve reddetme kalibrasyonu iyileştirmelerini barındırır.

Üretimde hâlâ 4o üzerinde çalışan ekipler için genellikle doğru sabitleme noktasıdır. Yeni yapımlarda ise konuşma çoktan başka yöne kaymıştır.

Kasım sürümünün getirdiği değişiklikler

Ağustos 2024 anlık görüntüsü, katı yapılandırılmış çıktıları getirdiği için yapısal ilginin büyük bölümünü topladı. Kasım sürümü ise daha sessiz bir değişiklikler bütünüydü, ancak üretimde en az onun kadar belirleyici oldu.

Akıl yürütme kalitesi. Kasım sürümü, çok adımlı istemlerde hem lansman modelinden hem de Ağustos anlık görüntüsünden gözle görülür biçimde daha güçlüdür. Düşünce zinciri tarzı çalışmalar, planlama istemleri, belirsiz bir spesifikasyondan özgün kod sentezleme — hepsinde ölçülebilir bir iyileşme görülür. Model, GPT-5 ailesinden gelen akıl yürütmeye özel ince ayarlanmış ardıllarının düzeyinde değildir, ancak 4o sınıfı için en yüksek noktayı temsil ediyordu.

Yazı kalitesi. Bu anlık görüntüden çıkan uzun biçimli düzyazı, Ağustos sürümünden belirgin biçimde daha az katıdır. Cümle yapısı daha çok çeşitlilik gösterir, istem gerektirmediğinde model daha az çekimser ifadeler kullanır ve paragraflar arasındaki üslup daha tutarlıdır. Blog taslakları, yönetici özetleri veya 4o üzerinde herhangi bir üretim metni üretimi yapan ekipler, yalnızca bu sebepten bile bu anlık görüntüye sabitleme eğilimindedir.

Reddetme kalibrasyonu. Sınırdaki istemlerde Ağustos sürümüne kıyasla biraz daha az agresiftir. Ağustos anlık görüntüsünün reddettiği bazı meşru uç durum istekleri, Kasım sürümünde sorunsuz şekilde geçer.

Anlık görüntüde neler yer alıyor

Kasım 2024'te bulunduğu hâliyle tam GPT-4o özellik yüzeyi. 128k token bağlam penceresiyle metin ve görsel girişi. Ses, realtime API ve aynı dönemdeki uç noktalar aracılığıyla sunulur. Ağustos sürümünden devralınan katı yapılandırılmış çıktılar. JSON modu. Fonksiyon çağırma. Chat Completions yüzeyinde akış desteği.

Bu anlık görüntüde olmayan şey ise GPT-4.1 ailesinden herhangi bir özelliktir. Bir milyon tokenlık bağlam, daha ileri akıl yürütme iyileştirmeleri, güncellenmiş tokenleştirici işleme — hepsi daha yeni ailede kalır. İş yükünüz bunlardan gerçekten yararlanıyorsa, yükseltme tartışması yalnızca anlık görüntü tarihi değil, model ailesi üzerinedir.

Ekipler neden özellikle Kasım'a sabitliyor

Bugün üretimdeki çoğu 4o sabitlemesi bu tarihe veya kayan etikete denk gelir. Nedenleri standart olanlardır.

Bu tanımlayıcıyı onaylamış uyum rejimleri. Kasım anlık görüntüsü, ona karşı tamamlanan denetim döngülerinin hâlâ geçerli olduğu kadar yenidir; bu da onu düzenlenmiş ortamlarda en çok onaylanan sabitlenmiş 4o sürümü yapar.

Kasım davranışına göre ayarlanmış aşağı akış işlem hatları. Bu anlık görüntünün yazı veya akıl yürütme kalitesi etrafında sistem kuran ekipler — içerik üretimi, özetleme hizmetleri, Kasım'ın belirli karar örüntülerine bağımlı ajan döngüleri — o davranışı kilitlemek için sabitleme yapar.

Geçişin ertelenmesi. GPT-4.1 veya GPT-5'e geçişi henüz tamamlamamış ekipler için Kasım'a sabitlemek, geçiş çalışması sürerken stabil bir hedef sunar. Geçiş sırasında üretimde kayan etiket kullanmak, değerlendirme raporlarında hareketli hedeflerin garantili reçetesidir.

Alanın bugünkü durumuyla karşılaştırma

Kasım anlık görüntüsündeki GPT-4o artık sınırın önünde değildir. GPT-4.1, GPT-5 ve Claude Opus 4.x ile Gemini 3 Pro aileleri; akıl yürütme, uzun bağlamlı çalışmalar ve yapılandırılmış çıktı uç durumlarında açıkça öndedir.

4o'nun hâlâ elinde tuttuğu şeyler ise iyi anlaşılmış bir dağıtım hikâyesi, sınır seviyesinden daha dostane bir fiyat noktası ve gpt-4o-audio ile realtime API üzerinden sunulan, üretim ses çalışmalarında hiçbir ardılın tam olarak yerini almadığı bir ses yüzeyidir.

Kategoriler arası karşılaştırma için bkz. /benchmarks/leaderboard. Hız ve zekâ dökümleri için /benchmarks/speed ve /benchmarks/intelligence.

Kullanımdan kaldırma riski

Bu anlık görüntü en güncel 4o sabitlemesidir ve dolayısıyla kullanımdan kaldırılmaya en uzak olanıdır, ancak deprecation ufku sonludur. OpenAI'nin tipik on iki ila on sekiz aylık döngüsü geçerlidir. Buna göre plan yapın.

4o ailesi tarafındaki doğal ardıl, Kasım'ın davranışının büyük bölümünü ve sonrasında devreye alınan küçük iyileştirmeleri taşıyan kayan etikettir. İleriye dönük hamle ise iş yüküne bağlı olarak GPT-4.1 veya GPT-5'e geçmektir. Kullanımdan kaldırma tarihi duyurulmadan önce değerlendirme döngüsünü hazır tutun.

Sabitleme örüntüsü

İşe yarayan örüntü:

  • Değerlendirmede, CI'de ve denetlenen iş akışlarında sabitleyin.
  • Üretim trafiğinde, devam eden küçük iyileştirmelerin yeniden üretilebilirlikten daha değerli olduğu yerlerde kayan etiket kullanın.
  • Davranışsal sapmayı yakalamak için sabit bir istem kümesine karşı, sabitlenmiş ile kayan sürüm arasında haftalık farklılaştırma yapın.

Özellikle Kasım için, kayan etiketin bu anlık görüntüden uzaklaşması bugün hâlâ yeterince küçüktür ve fark çalışması çoğu zaman temiz döner. Bu, zamanla değişir; fark işini takvimden düşürmeyin.

Kayan 4o yüzeyi için bkz. GPT-4o. Yeni yapımlarda 4o'nun yerini alan aile için bkz. GPT-4.1.

Seçim kriteri

gpt-4o-2024-11-20'yi şu durumlarda kullanın:

  • Bir uyum rejimi bu tanımlayıcıyı onayladıysa ve bu en son denetim döngünüzse.
  • Aşağı akış işlem hatları bu spesifik sürümün yazı veya akıl yürütme kalitesine bağımlıysa.
  • Üretimde 4o çalıştırıyorsanız ve GPT-4.1'e geçiş devam ederken stabil bir sabitleme noktası istiyorsanız.

Yeni yapımlar için daha yeni aileyi hedefleyin. Kasım, inilecek iyi bir noktaydı. Artık sıranın başında değil.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-4o-2024-11-20 — illustration 2

Sağlayıcı karşılaştırmasıLIVE

Sağlayıcı karşılaştırması
Bu modeli sunan her sağlayıcıyı karşılaştırın — maliyet temeli, kalite, gecikme ve çalışma süresi.
Azure OpenAI (EU - Sweden)AB
Girdi maliyeti$2.75
Çıktı maliyeti$11.00
KaliteHenüz test edilmedi
Gecikme (p50)Henüz test edilmedi
Çalışma süresiHenüz test edilmedi
Maliyetler 1M token başına (maliyet temeli)
OpenAIABDBu sunum
Girdi maliyetien iyi$2.50
Çıktı maliyeti$10.00
Kaliteen iyi100.0
Gecikme (p50)en iyi1,003 ms
Çalışma süresiHenüz test edilmedi
Maliyetler 1M token başına (maliyet temeli)

Konsensüs zekâsı

MODEL GENELİ

Konsensüs sinyalleri model geneli — henüz sağlayıcı başına ayrılmadı.

8.0

Ajan faydası (1–10)

Hassasiyet puanı

0

Benzersiz tespitler

0

Doğrulanmış istekler

Bulgu ciddiyeti

Yüksek 100%Orta 0%Düşük 0%

Topluluk oylarıLIVE

Topluluk oyları
Gerçek ziyaretçiler ne düşünüyor — sağlayıcı başına.
Azure OpenAI (EU - Sweden)AB

Henüz topluluk oyu yok.

OpenAIABD

Henüz topluluk oyu yok.

Daha fazla sonuç — sağlayıcı başına

Kategoriye göre kalite

YaratıcıOlgusalÇok dilliAkıl yürütme

Oyun değerlendirmesi

Henüz veri yok.

Jüri kararı

Tamam 95%Kısmi 5%Yanlış 0%

Oyunlar ve arena

Henüz veri yok.

Hız ve sağlık

1,003 ms

Gecikme (p50)

Çalışma süresi

Soru & cevap — göz atLIVE

1 / 80
🧠 zekâOpenAImultilingual · 2026-07-26puan: 100

Bir mağazada %20 indirim uygulanıyor. 150 TL olan bir ürün indirimden sonra kaç TL olur?

Bir ürünün indirimli fiyatını hesaplamak için şu adımları izleyebiliriz: 1. **Ürünün indirime tabi olan miktarını hesaplayalım:** %20 indirim demek, ürün fiyatının %20'si kadar bir miktarın fiyatından düşüleceği anlamına gelir. 150 TL'nin %20'si: \( 150 \times 0,20 = 30 \, TL \) 2. **Ürünün indirimli fiyatını bulalım:** \( 150 - 30 = 120 \, TL \) Sonuç: İndirimden sonra ürünün fiyatı **120 TL** olur. 🙂

Test geçmişi — tüm sağlayıcılarLIVE

Zaman içinde kalite puanıen son 91
05-1507-26
Hız — zaman içinde p50 gecikme

Bu model birkaç farklı günde test edildiğinde bir trend görünür.