İçeriğe geç
Seviye C — Uzman
Çalıştığı yer:USYapıldığı yer:United States
$13.00
çıktı · 1M token başına
Maliyet
1,326 ms
Yanıt hızı
1106
Zeka

Karar — özetLIVE

LIVE
şimdi · 2026-09-13

Performance decline with latency increase and factual accuracy concerns

Latency increased 46% Factual accuracy scores low Perfect reasoning performance Strong coding capabilities maintained

GPT-4o shows a mixed performance profile in the current benchmark window, with notable changes from the previous period. The overall quality score decreased from 86.0 to 83.0, accompanied by a significant 46% increase in median latency from 1706ms to 2483ms. This latency degradation represents a substantial shift in response times that users will likely notice in production environments. The model demonstrates exceptional performance in reasoning tasks, achieving a perfect score of 100, and maintains strong coding capabilities with a score of 96, slightly improved from the previous 92. However, a concerning weakness emerges in factual accuracy, with a score of only 53 in this category. This represents a significant gap in the model's knowledge retrieval and factual consistency that users should carefully evaluate for their use cases. The previous benchmark window highlighted multilingual capabilities and creative performance, but the current window focuses on different categories, making direct comparisons challenging. The shift in test categories suggests ongoing evaluation of different model dimensions. Users should be particularly cautious when deploying this version for fact-intensive applications and should anticipate longer response times compared to the previous benchmark period.

Kalite

83.0

Gecikme p50

2,483 ms

Test çalıştırmaları

5

1 / 20

Görsel ve açıklamaLIVE

OpenAI

gpt-4o

Seviye C — Uzman · 128K token

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-4o, OpenAI tarafından geliştirilen ve Mayıs 2024'te GPT-4 ailesinin bir parçası olarak yayımlanan çok modlu bir büyük dil modelidir. "o" eki, modelin "omni" yeteneklerine atıfta bulunur ve birleşik bir model mimarisi içinde metin, görüntü ve sesin işlenmesi ile üretilmesi için yerel destek sunduğunu belirtir. Bu model, OpenAI'nin ayrı uzmanlaşmış modellere bağımlı kalmak yerine birden fazla modaliteyi aynı anda işleyebilen daha entegre yapay zeka sistemleri oluşturma çabasını temsil eder. Model, 128,000 token'lık bir bağlam penceresine sahiptir; bu da tek bir istekte yaklaşık 96,000 kelime veya 300 sayfa metin işleyebilmesine olanak tanır. GPT-4o; içerik üretimi, analiz, kodlama desteği ve sohbet uygulamaları dahil olmak üzere genel amaçlı metin üretim görevleri için tasarlanmıştır. Daha hızlı yanıt süreleri ve daha yüksek verimlilik sunarken; muhakeme görevlerinde, çok dilli yeteneklerde ve görsel anlamada önceki GPT-4 varyantlarına kıyasla gelişmiş bir performans sergiler. OpenAI'nin model yelpazesinde GPT-4o, yeteneği erişilebilirlikle dengeleyen amiral gemisi bir sunum olarak konumlanır. Orijinal GPT-4 ve GPT-4 Turbo modellerine kıyasla daha verimli bir alternatif olarak yer alır; çoğu kıyaslamada karşılaştırılabilir veya daha üstün performans sağlarken istek başına daha az hesaplama kaynağına ihtiyaç duyar. Model, OpenAI'nin API'si aracılığıyla erişilebilir ve ChatGPT'nin standart hizmet katmanının temelini oluşturarak GPT-4 ailesinin en yaygın kullanılan modellerinden biri haline gelir.

OpenAI'nin kapsamlı eğitim verisi bu modelin geniş alan bilgisini destekliyor.

Tokonomix benchmark özeti

Yetenekler

toolssource: litellmvisionjson modepdf inputjson schemaparallel toolsprompt cachingmax output tokens: 16384
gpt-4o — illustration 1
GPT-4o: Çoklu modaliteyi varsayılan haline getiren model

GPT-4o, OpenAI'nin metin, görüntü ve sesi ayrı modelleri ortak bir API arkasında birbirine eklemek yerine aynı ileri geçişte tek bir modelle işleyen ilk denemesiydi. 128k token bağlam penceresiyle metin ve görüntü girdisini kabul eder ve özel ses yüzeyleri aracılığıyla sesli giriş ve çıkışı da işler. Avrupa ekiplerinin 2024 ve 2025'te sunduğu GPT-4 ailesi ürün yüzeyinin çoğu bu modelde çalışıyordu ve çoğu zaman kimse soyağacının farkına bile varmadı.

OpenAI'nin yığınındaki en yeni model değil ve artık yeni yapılar için önerilen varsayılan değil, ancak bugün üretimde en çok dağıtılan modellerden biri olmaya devam ediyor.

4o'nun değiştirdiği şeyler

Önceki nesil — GPT-4 ve GPT-4 Turbo — üzerine görüntü ve araç kullanımı aşılanmış güçlü metin modelleriydi. 4o farklı inşa edildi. Eğitim pipeline'ı en başından itibaren çoklu modal yeteneği hedefledi ve bu durum en net şekilde iki yerde kendini gösteriyor.

Birincisi, ses girdisi ve çıkışı. 4o, realtime API aracılığıyla sesli konuşmaları "Whisper ile transkribe et, GPT-4 ile üret, bir TTS modeliyle sentezle" eski yaklaşımından maddi olarak daha düşük gecikmeyle destekliyor. Sıra alma, modeller zincirinin hiçbir zaman tam olarak başaramadığı bir doğallıkta hissettiriyor.

İkincisi, görüntü anlama. 4o gösterge paneli ekran görüntülerini okur, render edilmiş PDF sayfalarından tabloları çıkarır, diyagramları tanımlar ve grafikleri daha önceki GPT-4 görüntü yüzeyinden daha güvenilir şekilde işler. Model, küçük eksen etiketlerine sahip yoğun grafiklerde kusursuz değil ve herhangi bir döngüde insan incelemesine ihtiyaç duyacak kadar sık el yazısını yanlış okuyor, ancak genel amaçlı görüntü girdisi için alanın geri kalanının yetişmesi gereken standardı belirledi.

Hız üçüncü değişiklikti. 4o, karşılaştırılabilir kalitede GPT-4 Turbo'dan belirgin şekilde daha düşük gecikmeyle sunuluyor. Etkileşimli kullanım durumları için fark anında hissedildi ve bugün hâlâ hissediliyor.

Şu anda nerede duruyor

OpenAI'nin mevcut ürün yelpazesi GPT-4.1 ve GPT-5 ailesini çoğu kıyaslamada 4o'nun üzerine konumlandırıyor. Dürüst çerçeveleme, 4o'nun yığının ortasında oturduğudur: en zor akıl yürütmede yeni sınır modellerinin açıkça gerisinde, GPT-3.5 neslinin rahatça önünde, birçok günlük iş yükünde GPT-4.1 mini ile karşılaştırılabilir.

128k bağlam penceresi onu en görünür şekilde eskiten kısımdır. Sınır katmanında milyon token'lık bağlamların standart hale geldiği bir yılın ardından, 128k ciddi belge işleme veya tam kod tabanı komutlarını içeren herhangi bir iş yükü için kısa hissettiriyor. Sohbet biçimli trafik için hâlâ yeterli.

4o-mini varyantı maliyet duyarlı çalışmalar için popüler olmaya devam ediyor, ancak yeni yapılar için 4.1 mini nesli daha iyi bir seçimdir. Ses yüzeyi, 4o'nun hâlâ rutin olarak tercih edildiği tek yerdir — gpt-4o-audio ve realtime API, yeni modellerin tam olarak çoğaltamadığı bir dağıtım hikayesine sahiptir.

Kategoriler arası sürekli karşılaştırma /benchmarks/leaderboard adresinde bulunur. Hız ve zeka dökümü /benchmarks/speed ve /benchmarks/intelligence adreslerinde yer alır.

Bugün nerede yetersiz kalıyor

Uzun bağlam çalışması. 128k artık sınırda rekabetçi değil. Belge ağırlıklı iş yükleri için GPT-4.1'e veya GPT-5'e geçin.

Sınır akıl yürütmesi. En zor planlama, matematik ve kod sentezi komutları GPT-5 veya Claude Opus 4.7'ye gider. 4o bunları işler ancak görünür şekilde çekinir ve daha az cilalı çıktı üretir.

Yerel görüntü üretimi. 4o metin ve görüntü girdisidir, metinden görüntüye değil. Üretim rotaları için özel görüntü modellerinden birini kullanın.

Avrupa veri yerleşimi. Doğrudan OpenAI API'si bölge sabitleme olmadan Azure altyapısında çalışır. Azure OpenAI Hizmeti ayrı bir sözleşme altında bölgesel dağıtımlar sunar. Sert AB yerleşim gereksinimleri altındaki ekipler için OVH barındırmalı bir Mistral veya Llama 3 örneği farklı bir konuşmadır; bkz. /usecases/local.

Dağıtım notları

API, artık tanıdık Chat Completions ve Responses yüzeyidir. Akış, araç çağrıları, JSON modu, yapılandırılmış çıktılar — hepsi beklendiği gibi çalışır. Ses için realtime API, istek-yanıt uç noktalarından farklı davranan ve kendi yük testi yaklaşımına ihtiyaç duyan bir WebSocket yüzeyi üzerinden çalışır.

Prompt önbellekleme desteklenir ve kararlı sistem komutlarınız veya getirme destekli önekleriniz varsa kuruluma değer. Maliyet faydası, yeniden kullanılan bağlama sahip herhangi bir dağıtımda hemen görünür.

Günlükler, kötüye kullanım izleme için varsayılan olarak otuz gün boyunca saklanır. API girdileri, siz kabul etmedikçe eğitim için kullanılmaz. Kurumsal sözleşmeler kapsamında sıfır saklama mevcuttur.

4o üzerine inşa etmiş ve bir yükseltme değerlendiren ekipler için pratik geçiş hedefi iş yükü şekline bağlıdır. Uzun bağlamlı metin ağırlıklı çalışma GPT-4.1'e gider. Akıl yürütme ağırlıklı çalışma GPT-5'e gider. Ses ağırlıklı çalışma, OpenAI dağıtım hikayesiyle eşleşen bir halef sunana kadar 4o realtime yüzeyinde kalır. Ayrıntılı ses yönlendirmesi için bkz. /usecases/voice.

Onu seçmek

Aşağıdakilere ihtiyacınız olduğunda bugün GPT-4o'ya ulaşın:

  • İyi anlaşılmış ve iyi belgelenmiş bir dağıtım hikayesine sahip çoklu modal girdi.
  • Karşılaştırılabilir kalitede GPT-4 Turbo'dan daha düşük gecikme.
  • Realtime API aracılığıyla ses girdisi veya çıkışı.
  • Sınır yeteneğine ihtiyaç duymayan mevcut bir OpenAI tabanlı pipeline'da pragmatik bir orta katman seçeneği.

Metin ağırlıklı uzun bağlam çalışmasını hedefleyen yeni yapılar için atlayın — GPT-4.1 daha iyi bir varsayılandır. GPT-5 veya Claude Opus 4.7'nin açıkça önde olduğu sınır akıl yürütmesi için atlayın.

/live-test adresinde yeni seçeneklerle yan yana deneyin. Birçok üretim trafiği için kalite deltası, sürüm numaralarının ima ettiğinden daha küçüktür ve 4o'nun daha düşük fiyat noktası seçimi neyin ucu olduğudur.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-4o — illustration 2gpt-4o — illustration 3

Sağlayıcı karşılaştırmasıLIVE

Sağlayıcı karşılaştırması
Bu modeli sunan her sağlayıcıyı karşılaştırın — fiyat, kalite, gecikme ve çalışma süresi.
Azure OpenAI (EU - Sweden)AB
Girdi maliyeti$3.58
Çıktı maliyeti$14.30
Kaliteen iyi1106
Gecikme (p50)Henüz test edilmedi
Çalışma süresiHenüz test edilmedi
Tokonomix üzerinde 1M token başına fiyatlar
OpenAIABDBu sunum
Girdi maliyetien iyi$3.25
Çıktı maliyeti$13.00
Kalite1106
Gecikme (p50)en iyi1,326 ms
Çalışma süresiHenüz test edilmedi
Tokonomix üzerinde 1M token başına fiyatlar

Konsensüs zekâsı

MODEL GENELİ

Konsensüs sinyalleri model geneli — henüz sağlayıcı başına ayrılmadı.

8.0

Ajan faydası (1–10)

17

Hassasiyet puanı

2

Benzersiz tespitler

5

Doğrulanmış istekler

Bulgu ciddiyeti

Yüksek 100%Orta 0%Düşük 0%

Topluluk oylarıLIVE

Topluluk oyları
Gerçek ziyaretçiler ne düşünüyor — sağlayıcı başına.
Azure OpenAI (EU - Sweden)AB

Henüz topluluk oyu yok.

OpenAIABD

Henüz topluluk oyu yok.

Daha fazla sonuç — sağlayıcı başına

Kategoriye göre kalite

Kod üretimiYaratıcıOlgusalÇok dilliAkıl yürütmeSağlık

Oyun değerlendirmesi

Henüz veri yok.

Jüri kararı

Tamam 93%Kısmi 5%Yanlış 1%

Oyunlar ve arena

1

oynanan

0

galibiyet

1

mağlubiyet

15.7 ± 3.6

TrueSkill (μ±σ)

Hız ve sağlık

1,326 ms

Gecikme (p50)

Çalışma süresi

Soru & cevap — göz atLIVE

1 / 81
🧠 zekâOpenAIreasoning · 2026-09-13puan: 100

In een dorp wonen 100 mensen. 60 hebben een hond, 40 een kat, 20 hebben beide. Hoeveel mensen hebben geen huisdier? Toon je redenering.

Om het aantal mensen te berekenen dat geen huisdier heeft, kunnen we gebruikmaken van de informatie over hoeveel mensen een hond, een kat of beide hebben. 1. **Mensen met een hond:** 60 2. **Mensen met een kat:** 40 3. **Mensen met beide huisdieren:** 20 We beginnen met het toepassen van de formule voor vereniging van twee verzamelingen om het totaal aantal mensen te berekenen dat ten minste één huisdier heeft. Deze formule is: \[ |H \cup K| = |H| + |K| - |H \cap K| \] waarbij: - \(|H \cup K|\) het aantal mensen is met ten minste één huisdier, - \(|H| = 60\) het aantal mensen met een hond is, - \(|K| = 40\) het aantal mensen met een kat is, - \(|H \cap K| = 20\) het aantal mensen met beide huisdieren is. Vervang de waarden in de formule: \[ |H \cup K| = 60 + 40 - 20 = 80 \] Dus 80 m

Test geçmişi — tüm sağlayıcılarLIVE

Zaman içinde kalite puanıen son 80
08-3009-13
Hız — zaman içinde p50 gecikmeen son 891 ms
08-2909-14