İçeriğe geç
Seviye C — Uzman
Çalıştığı yer:USYapıldığı yer:United States
$10.00
çıktı · 1M token başına (maliyet bazı)
Maliyet
606 ms
Yanıt hızı
Henüz test edilmedi
Zeka

Karar — özetLIVE

LIVE
şimdi · 2026-07-26

Multimodal model with expanded tool support and caching capabilities

Added prompt caching support Parallel tool calling enabled PDF input processing available

GPT-4o continues to demonstrate comprehensive multimodal capabilities across text, vision, and structured output tasks. The model now supports an expanded suite of capabilities including parallel tool calling, prompt caching, and PDF input processing alongside its existing vision, JSON mode, and JSON schema features. These additions represent meaningful enhancements to the model's practical utility in production environments, particularly for applications requiring efficient repeated interactions or complex document processing workflows. The tool and structured output capabilities remain stable, maintaining the foundation established in previous benchmark windows. Vision processing continues to function as expected for multimodal tasks. The addition of prompt caching should provide performance benefits for use cases involving repeated context, while parallel tool execution can streamline multi-step workflows. PDF input support extends document understanding beyond image-based approaches. Users should note that while the capability surface has expanded, the core model performance characteristics remain consistent with previous evaluations. This stability combined with incremental capability additions positions GPT-4o as a mature, feature-complete option for diverse AI applications requiring multimodal understanding and structured interaction patterns.

Quality

Latency p50

Test runs

0

1 / 15

Görsel ve açıklamaLIVE

OpenAI

gpt-4o

Seviye C — Uzman · 128K token

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-4o, OpenAI tarafından geliştirilen ve Mayıs 2024'te GPT-4 ailesinin bir parçası olarak yayımlanan çok modlu bir büyük dil modelidir. "o" eki, modelin "omni" yeteneklerine atıfta bulunur ve birleşik bir model mimarisi içinde metin, görüntü ve sesin işlenmesi ile üretilmesi için yerel destek sunduğunu belirtir. Bu model, OpenAI'nin ayrı uzmanlaşmış modellere bağımlı kalmak yerine birden fazla modaliteyi aynı anda işleyebilen daha entegre yapay zeka sistemleri oluşturma çabasını temsil eder. Model, 128,000 token'lık bir bağlam penceresine sahiptir; bu da tek bir istekte yaklaşık 96,000 kelime veya 300 sayfa metin işleyebilmesine olanak tanır. GPT-4o; içerik üretimi, analiz, kodlama desteği ve sohbet uygulamaları dahil olmak üzere genel amaçlı metin üretim görevleri için tasarlanmıştır. Daha hızlı yanıt süreleri ve daha yüksek verimlilik sunarken; muhakeme görevlerinde, çok dilli yeteneklerde ve görsel anlamada önceki GPT-4 varyantlarına kıyasla gelişmiş bir performans sergiler. OpenAI'nin model yelpazesinde GPT-4o, yeteneği erişilebilirlikle dengeleyen amiral gemisi bir sunum olarak konumlanır. Orijinal GPT-4 ve GPT-4 Turbo modellerine kıyasla daha verimli bir alternatif olarak yer alır; çoğu kıyaslamada karşılaştırılabilir veya daha üstün performans sağlarken istek başına daha az hesaplama kaynağına ihtiyaç duyar. Model, OpenAI'nin API'si aracılığıyla erişilebilir ve ChatGPT'nin standart hizmet katmanının temelini oluşturarak GPT-4 ailesinin en yaygın kullanılan modellerinden biri haline gelir.

OpenAI'nin kapsamlı eğitim verisi bu modelin geniş alan bilgisini destekliyor.

Tokonomix benchmark özeti

Yetenekler

toolssource: litellmvisionjson modepdf inputjson schemaparallel toolsprompt cachingmax output tokens: 16384
gpt-4o — illustration 1
GPT-4o: Çoklu modaliteyi varsayılan haline getiren model

GPT-4o, OpenAI'nin metin, görüntü ve sesi ayrı modelleri ortak bir API arkasında birbirine eklemek yerine aynı ileri geçişte tek bir modelle işleyen ilk denemesiydi. 128k token bağlam penceresiyle metin ve görüntü girdisini kabul eder ve özel ses yüzeyleri aracılığıyla sesli giriş ve çıkışı da işler. Avrupa ekiplerinin 2024 ve 2025'te sunduğu GPT-4 ailesi ürün yüzeyinin çoğu bu modelde çalışıyordu ve çoğu zaman kimse soyağacının farkına bile varmadı.

OpenAI'nin yığınındaki en yeni model değil ve artık yeni yapılar için önerilen varsayılan değil, ancak bugün üretimde en çok dağıtılan modellerden biri olmaya devam ediyor.

4o'nun değiştirdiği şeyler

Önceki nesil — GPT-4 ve GPT-4 Turbo — üzerine görüntü ve araç kullanımı aşılanmış güçlü metin modelleriydi. 4o farklı inşa edildi. Eğitim pipeline'ı en başından itibaren çoklu modal yeteneği hedefledi ve bu durum en net şekilde iki yerde kendini gösteriyor.

Birincisi, ses girdisi ve çıkışı. 4o, realtime API aracılığıyla sesli konuşmaları "Whisper ile transkribe et, GPT-4 ile üret, bir TTS modeliyle sentezle" eski yaklaşımından maddi olarak daha düşük gecikmeyle destekliyor. Sıra alma, modeller zincirinin hiçbir zaman tam olarak başaramadığı bir doğallıkta hissettiriyor.

İkincisi, görüntü anlama. 4o gösterge paneli ekran görüntülerini okur, render edilmiş PDF sayfalarından tabloları çıkarır, diyagramları tanımlar ve grafikleri daha önceki GPT-4 görüntü yüzeyinden daha güvenilir şekilde işler. Model, küçük eksen etiketlerine sahip yoğun grafiklerde kusursuz değil ve herhangi bir döngüde insan incelemesine ihtiyaç duyacak kadar sık el yazısını yanlış okuyor, ancak genel amaçlı görüntü girdisi için alanın geri kalanının yetişmesi gereken standardı belirledi.

Hız üçüncü değişiklikti. 4o, karşılaştırılabilir kalitede GPT-4 Turbo'dan belirgin şekilde daha düşük gecikmeyle sunuluyor. Etkileşimli kullanım durumları için fark anında hissedildi ve bugün hâlâ hissediliyor.

Şu anda nerede duruyor

OpenAI'nin mevcut ürün yelpazesi GPT-4.1 ve GPT-5 ailesini çoğu kıyaslamada 4o'nun üzerine konumlandırıyor. Dürüst çerçeveleme, 4o'nun yığının ortasında oturduğudur: en zor akıl yürütmede yeni sınır modellerinin açıkça gerisinde, GPT-3.5 neslinin rahatça önünde, birçok günlük iş yükünde GPT-4.1 mini ile karşılaştırılabilir.

128k bağlam penceresi onu en görünür şekilde eskiten kısımdır. Sınır katmanında milyon token'lık bağlamların standart hale geldiği bir yılın ardından, 128k ciddi belge işleme veya tam kod tabanı komutlarını içeren herhangi bir iş yükü için kısa hissettiriyor. Sohbet biçimli trafik için hâlâ yeterli.

4o-mini varyantı maliyet duyarlı çalışmalar için popüler olmaya devam ediyor, ancak yeni yapılar için 4.1 mini nesli daha iyi bir seçimdir. Ses yüzeyi, 4o'nun hâlâ rutin olarak tercih edildiği tek yerdir — gpt-4o-audio ve realtime API, yeni modellerin tam olarak çoğaltamadığı bir dağıtım hikayesine sahiptir.

Kategoriler arası sürekli karşılaştırma /benchmarks/leaderboard adresinde bulunur. Hız ve zeka dökümü /benchmarks/speed ve /benchmarks/intelligence adreslerinde yer alır.

Bugün nerede yetersiz kalıyor

Uzun bağlam çalışması. 128k artık sınırda rekabetçi değil. Belge ağırlıklı iş yükleri için GPT-4.1'e veya GPT-5'e geçin.

Sınır akıl yürütmesi. En zor planlama, matematik ve kod sentezi komutları GPT-5 veya Claude Opus 4.7'ye gider. 4o bunları işler ancak görünür şekilde çekinir ve daha az cilalı çıktı üretir.

Yerel görüntü üretimi. 4o metin ve görüntü girdisidir, metinden görüntüye değil. Üretim rotaları için özel görüntü modellerinden birini kullanın.

Avrupa veri yerleşimi. Doğrudan OpenAI API'si bölge sabitleme olmadan Azure altyapısında çalışır. Azure OpenAI Hizmeti ayrı bir sözleşme altında bölgesel dağıtımlar sunar. Sert AB yerleşim gereksinimleri altındaki ekipler için OVH barındırmalı bir Mistral veya Llama 3 örneği farklı bir konuşmadır; bkz. /usecases/local.

Dağıtım notları

API, artık tanıdık Chat Completions ve Responses yüzeyidir. Akış, araç çağrıları, JSON modu, yapılandırılmış çıktılar — hepsi beklendiği gibi çalışır. Ses için realtime API, istek-yanıt uç noktalarından farklı davranan ve kendi yük testi yaklaşımına ihtiyaç duyan bir WebSocket yüzeyi üzerinden çalışır.

Prompt önbellekleme desteklenir ve kararlı sistem komutlarınız veya getirme destekli önekleriniz varsa kuruluma değer. Maliyet faydası, yeniden kullanılan bağlama sahip herhangi bir dağıtımda hemen görünür.

Günlükler, kötüye kullanım izleme için varsayılan olarak otuz gün boyunca saklanır. API girdileri, siz kabul etmedikçe eğitim için kullanılmaz. Kurumsal sözleşmeler kapsamında sıfır saklama mevcuttur.

4o üzerine inşa etmiş ve bir yükseltme değerlendiren ekipler için pratik geçiş hedefi iş yükü şekline bağlıdır. Uzun bağlamlı metin ağırlıklı çalışma GPT-4.1'e gider. Akıl yürütme ağırlıklı çalışma GPT-5'e gider. Ses ağırlıklı çalışma, OpenAI dağıtım hikayesiyle eşleşen bir halef sunana kadar 4o realtime yüzeyinde kalır. Ayrıntılı ses yönlendirmesi için bkz. /usecases/voice.

Onu seçmek

Aşağıdakilere ihtiyacınız olduğunda bugün GPT-4o'ya ulaşın:

  • İyi anlaşılmış ve iyi belgelenmiş bir dağıtım hikayesine sahip çoklu modal girdi.
  • Karşılaştırılabilir kalitede GPT-4 Turbo'dan daha düşük gecikme.
  • Realtime API aracılığıyla ses girdisi veya çıkışı.
  • Sınır yeteneğine ihtiyaç duymayan mevcut bir OpenAI tabanlı pipeline'da pragmatik bir orta katman seçeneği.

Metin ağırlıklı uzun bağlam çalışmasını hedefleyen yeni yapılar için atlayın — GPT-4.1 daha iyi bir varsayılandır. GPT-5 veya Claude Opus 4.7'nin açıkça önde olduğu sınır akıl yürütmesi için atlayın.

/live-test adresinde yeni seçeneklerle yan yana deneyin. Birçok üretim trafiği için kalite deltası, sürüm numaralarının ima ettiğinden daha küçüktür ve 4o'nun daha düşük fiyat noktası seçimi neyin ucu olduğudur.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-4o — illustration 2gpt-4o — illustration 3

Sağlayıcı karşılaştırmasıLIVE

Sağlayıcı karşılaştırması
Bu modeli sunan her sağlayıcıyı karşılaştırın — maliyet temeli, kalite, gecikme ve çalışma süresi.
Azure OpenAI (EU - Sweden)AB
Girdi maliyeti$2.75
Çıktı maliyeti$11.00
KaliteHenüz test edilmedi
Gecikme (p50)Henüz test edilmedi
Çalışma süresiHenüz test edilmedi
Maliyetler 1M token başına (maliyet temeli)
OpenAIABDBu sunum
Girdi maliyetien iyi$2.50
Çıktı maliyeti$10.00
KaliteHenüz test edilmedi
Gecikme (p50)en iyi606 ms
Çalışma süresiHenüz test edilmedi
Maliyetler 1M token başına (maliyet temeli)

Konsensüs zekâsı

MODEL GENELİ

Konsensüs sinyalleri model geneli — henüz sağlayıcı başına ayrılmadı.

8.0

Ajan faydası (1–10)

17

Hassasiyet puanı

2

Benzersiz tespitler

5

Doğrulanmış istekler

Bulgu ciddiyeti

Yüksek 100%Orta 0%Düşük 0%

Topluluk oylarıLIVE

Topluluk oyları
Gerçek ziyaretçiler ne düşünüyor — sağlayıcı başına.
Azure OpenAI (EU - Sweden)AB

Henüz topluluk oyu yok.

OpenAIABD

Henüz topluluk oyu yok.

Daha fazla sonuç — sağlayıcı başına

Kategoriye göre kalite

YaratıcıOlgusalÇok dilliAkıl yürütme

Oyun değerlendirmesi

Henüz veri yok.

Jüri kararı

Tamam 94%Kısmi 6%Yanlış 0%

Oyunlar ve arena

1

oynanan

0

galibiyet

1

mağlubiyet

15.7 ± 3.6

TrueSkill (μ±σ)

Hız ve sağlık

606 ms

Gecikme (p50)

Çalışma süresi

Soru & cevap — göz atLIVE

1 / 81
🧠 zekâOpenAImultilingual · 2026-07-26puan: 100

Bir mağazada %20 indirim uygulanıyor. 150 TL olan bir ürün indirimden sonra kaç TL olur?

150 TL olan bir ürün %20 indirim uygulanınca: Öncelikle indirimi hesaplayalım: 150 TL x 0.20 = 30 TL Bu 30 TL'lik indirim uygulandıktan sonra ürünün yeni fiyatı: 150 TL - 30 TL = 120 TL Dolayısıyla, indirimden sonra ürünün fiyatı 120 TL olur.

Test geçmişi — tüm sağlayıcılarLIVE

Zaman içinde kalite puanıen son 96
07-1907-26
Hız — zaman içinde p50 gecikmeen son 580 ms
07-1307-30