İçeriğe geç
Seviye B — Üretim
Çalıştığı yer:USYapıldığı yer:United States

Kullanımdan kaldırma tarihi

Sağlayıcı bu modeli 11 Aralık 2026 tarihinde kullanımdan kaldıracak. O zamana kadar her zamanki gibi çalışır.

OpenAI

gpt-5-2025-08-07

Seviye B — Üretim

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-5-2025-08-07, OpenAI'ın Ağustos 2025'te piyasaya sürdüğü son nesil dil modelidir. Bu model, GPT-4 serisine göre önemli bir mimari ilerleme sunarak geliştirilmiş muhakeme yetenekleri, artırılmış olgusal doğruluk ve çeşitli doğal dil işleme görevlerinde daha sağlam performans içerir. Karmaşık analiz, yaratıcı yazım, teknik dokümantasyon, kod üretimi ve çok adımlı problem çözme dahil olmak üzere genel amaçlı metin üretimi için tasarlanmıştır. Model, açıklanmamış bir bağlam penceresi boyutuna sahip standart metin üretim yetenekleri sunar. GPT-5, öncüllerine kıyasla mantıksal tutarlılıkta kayda değer iyileştirmeler, azaltılmış halüsinasyon oranları ve daha iyi talimat takibi gösterir. Önceki sürümlerden daha güncel bir bilgi kesme noktası üzerinde eğitilmiştir, ancak OpenAI belirli eğitim verisi kompozisyonunu veya parametre sayılarını açıklamamıştır. Model, özellikle uzun sohbetlerde tutarlılığı koruma ve kullanıcının örtük niyetini yorumlamayı gerektiren nüanslı talimatları işleme konusunda güçlü performans sergiler. OpenAI'ın model yelpazesinde GPT-5-2025-08-07, genel erişime açık en yetenekli model olarak en üst katmanda yer alır. GPT-4 Turbo ve GPT-4o gibi varyantları içeren GPT-4 ailesinin halefidir. Bu model, son teknoloji dil anlama ve üretim yetenekleri gerektiren kullanıcılar için OpenAI'ın amiral gemi ürünü olarak konumlandırılmıştır. Tarih damgalı sürüm tanımlayıcısı, Ağustos 2025'ten bu spesifik anlık görüntüyü belirtir ve OpenAI'ın üretim uygulamalarında tutarlılık ve tekrarlanabilirlik için sürümlenmiş yayınlar sürdürme geleneğini takip eder.

GPT-5-2025-08-07, OpenAI'ın genel amaçlı dil modelleri arasında en gelişmiş mimariyi sunan, mantıksal tutarlılık ve talimat takibinde önceki nesillere göre belirgin iyileştirmeler getiren yeni nesil modelidir.

Tokonomix model karşılaştırma analizi
Bölüm 01

Hız analizi

Tüm benchmark çalıştırmalarında ölçülen gecikme. P50 (medyan) ve P95 (95. yüzdelik) normal ve yoğun yük altında yanıt hızının gerçekçi bir resmini verir.

P50 gecikme (medyan)P95 gecikme96 runs
476163227873943509808-2209-14ms
Bölüm 02

Kalite puanları

Bu modelin her soru kategorisinde sahanın geri kalanına göre nerede durduğu; aynı sorular üzerinde ikili karşılaştırmayla hesaplanır. Ham jüri puanı her sayının altındadır.

56%
Kod üretimi
jüri ortalaması 67
3%
Yaratıcı
jüri ortalaması 35
24%
Olgusal
jüri ortalaması 71
37%
Çok dilli
jüri ortalaması 48
58%
Akıl yürütme
jüri ortalaması 63

Kategori başına kazanma oranı: bu modelin o kategoriden bir soruda ortalama bir modeli ne sıklıkla yendiği. %50 ortalamadır, kalma notu değildir. Doğru cevap yüzdesi de değildir.

Bölüm 03

Fiyatlar

Bu modeli Tokonomix üzerinden kullandığınızda milyon token başına ödediğiniz tutar ve tipik bir konuşma için tahmini maliyet.

💰
API tarifeleri — gpt-5-2025-08-07
$1.63 1M giriş token başına
$13.00 1M çıkış token başına
≈ $0.0036 tipik konuşma başına (800 token)
Giriş vs çıkış fiyatı (1M token başına)
1M giriş token başına$1.63
1M çıkış token başına$13.00
Bölüm 04

Saniye başına token

Ölçülen P50 gecikmesinden türetilen saniye başına token verimi. Yüksek daha iyidir; dalgalanmalar sağlayıcı tarafındaki yükü yansıtır.

Verim (token / s)218 / avg 259
41636

P50 gecikme × 200 çıkış token tahmininden hesaplandı — mutlak rakam bu varsayıma bağlıdır; önemli olan eğilimdir.

Bölüm 05

Güçlü & zayıf yönler

Benchmark sonuçları ve gerçek kullanım senaryolarına dair toplu topluluk geri bildirimine dayanır.

Güçlü yönler

Gelişmiş mantıksal akıl yürütmeAzaltılmış halüsinasyon oranlarıUzun konuşmalarda tutarlılıkÖrtük niyet yorumlama yeteneğiÇok adımlı problem çözmeGüncel bilgi tabanıKod üretiminde yüksek kaliteYaratıcı yazımda güçlü performans

Zayıf yönler

Bağlam penceresi boyutu belirsizMaliyet yapısı açıklanmamışParametre sayısı ve eğitim detayları gizliUzun vadeli versiyon desteği belirsiz
Bölüm 06

Yetenekler

toolssource: litellmvisionjson modepdf inputreasoningjson schemaparallel toolsprompt cachingmax output tokens: 128000
Bölüm 07

Sık sorulan sorular

OpenAI, GPT-5'in mantıksal tutarlılık, talimat takibi ve halüsinasyon oranlarında belirgin iyileştirmeler sunduğunu belirtiyor. Ancak parametre sayısı ve eğitim detayları açıklanmadığı için kesin kıyaslamalar henüz sınırlı. Özellikle karmaşık akıl yürütme gerektiren görevlerde GPT-4 ailesine göre üstünlük gösterdiği raporlanıyor.

GPT-5, karmaşık akıl yürütme ve uzun bağlam koherensı gerektiren görevlerde güçlü bir seçenek olmakla birlikte, belirsiz teknik özellikleri ve fiyatlandırma detayları nedeniyle kurumsal planlama aşamasında dikkatli değerlendirme gerektiriyor.

Tokonomix editör değerlendirmesi
Bölüm 08

Kullanılabilirlik

Kullanılabilirlik

Henüz ölçüm verisi yok

Bu model için kullanılabilirlik istatistiklerini göstermek için yeterli API çağrısı henüz kaydedilmedi. Veri, model canlı trafik almaya başlayınca görünür.

Bölüm 09

Tokonomix kıyaslama kararları

⚖️
Endorsed by 2 judges
Independent LLM judges evaluated this model on our weekly intelligence tests
cohere/command-a100/100 · 1 runs
1 correct0 partial0 wrong100% accuracy
claude-sonnet-4-559/100 · 46 runs
24 correct1 partial21 wrong52% accuracy
2026-09-13

GPT-5 adds reasoning, vision, and PDF input capabilities

OpenAI's GPT-5 represents a significant capability expansion with the introduction of multiple new features. The model now supports native reasoning capabilities, vision processing for image inputs, and direct PDF document handling. Tool use has been enhanced with support for parallel tool calls, alongside JSON mode output with both basic json_mode and structured json_schema options. Prompt caching has been added to improve efficiency for repeated context usage. No benchmark performance data is available in the current window to assess quantitative improvements in accuracy, speed, or quality metrics across standard tasks. The previous benchmark window similarly lacked performance measurements, making it impossible to evaluate whether the new capabilities come with measurable improvements in core language understanding, reasoning quality, or response coherence. Users gain access to a more versatile model with multimodal inputs and structured outputs, but should await independent testing to understand how these features perform in practice and whether the reasoning capability delivers substantive improvements over GPT-4's chain-of-thought approaches.

Kalite

Gecikme p50

Test çalıştırmaları

0

Native reasoning capability added Vision and PDF input support Parallel tool calls enabled No performance benchmarks available
Bölüm 10

Tam model profili

gpt-5-2025-08-07 — illustration 1
GPT-5 (2025-08-07 anlık görüntüsü): sabitlenmiş orijinal

Bu, orijinal GPT-5 temel modelinin tarihli anlık görüntüsüdür; 7 Ağustos 2025'te yayımlanmış ve o noktada dondurulmuştur. Değişken gpt-5 etiketi, ona işaret eden ekipler altında ilerlemeye devam etse de, bu tarihli sürüm belirli bir ağırlık setini, belirli bir davranış profilini ve tek bir yeniden üretilebilir eseri yakalar. Bu da onu dar ama önemli bir iş kümesi için kullanışlı kılar: karşılaştırma temel çizgileri, düzenlenmiş iş akışları ve altı ay sonra aynı modele işaret edip aynı yanıtı almayı gerektiren her ürün.

Tarihli anlık görüntüler neden var

OpenAI her nesli iki farklı biçimde yayımlar. Değişken ad (gpt-5) o anda önerilen anlık görüntüyü izler. Tarihli ad (gpt-5-2025-08-07) ağırlıkların belirli bir sürümünü sabitler. Değişken etiket sessiz iyileştirmelerden yararlanır; tarihli etiket ise sizi asla şaşırtmamasının avantajını sunar.

Zaman içinde değerlendirme karşılaştırmaları için tarihli etiket tek dürüst seçimdir. Aralık ayında yayımladığınız kıyaslama raporunuz "GPT-5 testlerimizde X puan aldı" diyorsa ve birisi bunu Mayıs'ta değişken etikete karşı tekrar çalıştırırsa, aynı modeli karşılaştırmıyor olacaktır. Tarihli anlık görüntü bu sorunu çözer. 7 Ağustos 2025'teki davranış, OpenAI bu uç noktayı eninde sonunda kullanımdan kaldırana kadar, ne zaman buraya bağlanırsanız alacağınız davranıştır.

Bu anlık görüntü nedir

GPT-5, GPT-5 ailesinin ilk modeliydi ve çok modlu bir metin-ve-görsel ileri-cephe modeli olarak yayımlandı. 2025-08-07 anlık görüntüsü lansman davranışını yansıtır: OpenAI'nin 2025 ortasında kullandığı bilgi kesim tarihine kadarki eğitim verisi, orijinal güvenlik eğitimi geçişi, orijinal görsel-kodlayıcı kalibrasyonu, orijinal araç kullanımı davranışları.

Sonraki değişken etiket güncellemeleri bu özellikleri kaydırdı. Daha geniş 5.x serisi boyunca belgelenen değişiklikler arasında uç durumlarda iyileştirilmiş talimat takibi, belirli içerik kategorilerinde ayarlanmış reddetme davranışı ve görsel OCR'da artımlı iyileştirmeler yer aldı. Bu değişikliklerin hiçbiri bu anlık görüntüye dokunmuyor. Ağustos 2025'te ne aldıysanız, bugün de onu alıyorsunuz.

Kaputun altında

Model, araya eklenmiş metin ve görsel girdileri kabul eden ve yalnızca metin çıktısı üreten bir transformer dekoderdir. Parametre sayısı, uzman yönlendirme ayrıntıları ve mimari seçimlerin kesin biçimi kamuya açık değildir. Tokenizasyon, GPT-5 BPE sözlüğünü kullanır. Görsel girdiler, fayans başına sabit bir token maliyetiyle fayans-kodlanır; bu da çok sayfalı belge iş yüklerinde hızla birikir.

Bu anlık görüntü için eğitim kesim tarihi 2025 ortasındadır. Model, o döneme ait ana akım dil standartlarını ve framework sürümlerini bilir ve daha yeni olan her şey hakkında neşeyle uydurma yapar. Yakın olayları veya yeni kütüphane API'lerini içeren iş akışları için bu önemlidir — anlık görüntüyü sabitleyin, bilginin yaşlandığını kabul edin ve güncel olaylara dair sorguları modelin parametrik bilgisine güvenmek yerine arama veya web aramasıyla yönlendirin.

Bugün nerede duruyor

Daha geniş ileri-cephe model manzarasına karşı, GPT-5'in Ağustos 2025 anlık görüntüsü genel amaçlı görevlerde üst kademede, görsel-ağırlıklı işlerde ise üst-orta kademede konumlanır. Daha yeni 5.1, 5.2 ve sonraki anlık görüntüler çoğu metrikte onun önüne geçti. Zeka liderlik tablosu karşılaştırmalı sıralamayı izler.

Ağustos 2025'te sabitlenmiş bir anlık görüntü için bu beklenen örüntüdür. Amaç, Mayıs 2026'da mevcut en iyi mutlak model olmak değildir; amaç, karşılaştırmaların ve denetimlerin geçerli kalması için Mayıs 2026'da Ağustos 2025'tekiyle aynı model olmaktır.

Bu anlık görüntüye ne zaman sabitlenmeli

Yeniden üretilebilirlik en yüksek kaliteden daha değerli olduğunda gpt-5-2025-08-07'e başvurun. Belirgin kullanım durumları:

Zaman içinde değerlendirme karşılaştırmaları. Kıyaslama paketiniz bu anlık görüntü yayımlandığında ona karşı çalıştırıldıysa, değişken etiket yerine yine bu anlık görüntüye karşı çalıştırın. Aksi takdirde kendi değişikliğinizi değil, modelin evrimini ölçüyorsunuz demektir.

Denetim izlerinin belirli bir çıktıyı üreten kesin modeli tanımlaması gereken düzenlenmiş kararlar. Bir denetçi hangi sürümü kullandığınızı sorduğunda "gpt-5 kullandık" yetersiz bir cevaptır. "gpt-5-2025-08-07 kullandık" yeterlidir.

Kalite SLA'ları belirli bir model davranışına göre kalibre edilmiş müşteriye dönük özellikler. İstemleriniz ve birkaç örnekli örnekleriniz bu anlık görüntüye göre ayarlandıysa, yeniden ayarlama yapmadan daha yenisine geçmek ince gerilemeler riski taşır.

Kontrolün test süresi boyunca gerçekten sabit kalması gereken uzun soluklu A/B deneyleri.

Bu anlık görüntüye ne zaman sabitlenmemeli

Yeni özelliklerin geliştirilmesi için bundan kaçının. Bunun yerine değişken etiketi veya en son tarihli anlık görüntüyü kullanın; geliştirme yaparken mevcut en yetenekli modeli istersiniz, hâlâ çalışan en eskisini değil.

Daha yeni anlık görüntülerdeki kazanımların gerçek olduğu ve davranış kaymasının maliyetinin düşük olduğu genel amaçlı sohbet ve içerik iş akışları için bundan kaçının. 5.1, 5.2 ve sonraki anlık görüntüler aynı iş yüklerinde daha iyidir. Yalnızca geçmiş önem taşıdığında geçmişe sabitlenin.

2025 ortasından sonraki olaylara dair bilgiye dayanan herhangi bir istem çalıştırıyorsanız bundan kaçının. Model bilmiyor. Tahmin edecek. Tahminler bazen doğru görünecek, bazen ise tamamen yanlış olacak.

Operasyonel notlar

OpenAI, tarihli anlık görüntüler için kullanımdan kaldırma takvimleri yayımlar. Eski anlık görüntüler eninde sonunda kullanımdan kalkar. Bu, buna olduğunda, bu etikete sabitlenmiş kodunuz hata döndürmeye başlayacaktır. Önceden plan yapın: kullanımdan kaldırma duyurularına abone olun ve bir sonraki sabitleyeceğiniz anlık görüntüye doğru ileriye dönük bir yol sürdürün.

Görsel yeteneğin yük taşıdığı veri çıkarma iş akışları için Ağustos 2025 anlık görüntüsü yeterli düzeydedir ancak daha sonraki görsel-kodlayıcı iyileştirmeleri tarafından geride bırakılmıştır. İş izin veriyorsa, sabitlemeyi taşıyıp taşımayacağınıza karar vermeden önce birkaç hafta boyunca aynı belgeleri bu anlık görüntü ve daha yeni bir anlık görüntü üzerinden paralel olarak çalıştırın.

Alternatifler

Aynı tür sabitlenmiş yeniden üretilebilirliğe ihtiyaç duyan ancak farklı bir modele önem veren iş akışları için, her ileri-cephe sağlayıcısı artık değişken etiketlerinin yanında tarihli anlık görüntüler de yayımlıyor. Bu örüntü sektör standardıdır. Kalite ve modalite gereksinimlerinize uyan modeli seçin, ardından değişken sürümünü değil, tarihli sürümünü sabitleyin.

Rutin iş yüklerinde saf maliyet optimizasyonu için, 5.x ailesinin daha küçük üyeleri (mini ve nano kademeleri) genel amaçlı sohbetin gerçekte ihtiyaç duyduğu şeylerin çoğunu maliyetin küçük bir kısmına karşılar. Orada da yeniden üretilebilirliğe önem veriyorsanız o anlık görüntüleri de sabitleyin.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-5-2025-08-07 — illustration 2gpt-5-2025-08-07 — illustration 3
Son otomatik test
14 Eyl 2026 · 20:03 UTC · Hız testi
P50 gecikme
919 ms
P95 gecikme
2832 ms
Hatalar
0 / 6 çalıştırma
Son inceleyen Tokonomix Ekibi·26 Mayıs 2026