İçeriğe geç
Seviye B — Üretim
Çalıştığı yer:USYapıldığı yer:United States
$10.00
çıktı · 1M token başına (maliyet bazı)
Maliyet
1,317 ms
Yanıt hızı
100 / 100
Zeka

Karar — özetLIVE

LIVE
şimdi · 2026-07-26

Quality decline and significant latency regression observed

Latency increased 162% Overall quality dropped 2.8 points Factual accuracy declined to 91 Perfect reasoning and multilingual scores

This benchmark window reveals a notable performance regression for GPT-5.1. The overall quality score decreased from 99.7 to 96.9, representing a 2.8-point drop that suggests meaningful capability changes. Most concerning is the latency increase of 162 percent, with median response time rising from 1359ms to 3555ms. This substantially impacts user experience across all use cases. Category performance shows a mixed picture. Reasoning and multilingual capabilities achieved perfect scores of 100, demonstrating strong performance in these domains. The multilingual score maintained its previous perfect rating. However, factual accuracy dropped to 91, a concerning regression in a critical capability area. Creative writing remained strong at 97, though this represents a slight decrease from the previous 99. The coding category, which scored perfectly in the prior window, was not measured in the current evaluation period. Users should expect noticeably slower response times compared to the previous version, which may affect real-time applications and conversational flows. The quality decline, while not catastrophic, suggests this version may be less reliable for fact-intensive tasks. The maintained excellence in reasoning and multilingual tasks provides some reassurance for those specific workloads.

Quality

96.9

Latency p50

3,555 ms

Test runs

5

1 / 11

Görsel ve açıklamaLIVE

OpenAI

gpt-5.1-2025-11-13

Seviye B — Üretim

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-5.1-2025-11-13, OpenAI tarafından geliştirilen ve Kasım 2025'te GPT-5 serisinin bir parçası olarak piyasaya sürülen büyük bir dil modelidir. Bu model, OpenAI'ın amiral gemisi dil modeli serisine yönelik yinelemeli bir güncellemeyi temsil eder ve önceki versiyonlara kıyasla mimari iyileştirmeler ile daha güncel veriler üzerinde eğitim içerir. Doğal dil anlama, içerik oluşturma, soru yanıtlama, kod üretimi ve sohbet uygulamaları dahil olmak üzere genel amaçlı metin üretim görevleri için tasarlanmıştır. Model, karmaşık muhakeme, çok turlu diyalog ve talimat takibi desteği ile standart metin üretim yeteneklerine sahiptir. Kesin bağlam penceresi boyutu kamuya açıklanmamış olsa da, modern büyük dil modelleriyle tutarlı şekilde önemli girdi uzunluklarını işleyebileceği beklenmektedir. GPT-5.1, GPT-5 serisi tarafından oluşturulan temel üzerine inşa edilerek muhakeme kıyaslamalarında gelişmiş performans ve eğitim verisi kesim tarihindeki güncellemeler sayesinde iyileştirilmiş olgusal doğruluk sunar. OpenAI'ın model yelpazesinde GPT-5.1-2025-11-13, GPT-5 ailesinde mevcut nesil bir ürün olarak yer alır. Tarih damgalı versiyon tanımlayıcısı, bunun Kasım 2025'te yayınlanan belirli bir anlık görüntü olduğunu gösterir ve OpenAI'ın tutarlılık ve tekrarlanabilirlik için sürümlenmiş yayınlar sağlama uygulamasını yansıtır. Bu model, çeşitli alanlarda üretim uygulamaları, araştırma ve geliştirme için güvenilir, genel amaçlı dil modeli yetenekleri gerektiren kullanıcılara hizmet eder.

GPT-5.1-2025-11-13, OpenAI'ın beşinci nesil dil modeli serisinin güncel sürümü olarak genel amaçlı metin üretimi ve karmaşık muhakeme görevlerinde güçlü bir performans sunuyor.

Tokonomix model değerlendirmesi

Yetenekler

toolssource: litellmvisionjson modepdf inputreasoningjson schemaparallel toolsprompt cachingmax output tokens: 128000
gpt-5.1-2025-11-13 — illustration 1
gpt-5.1-2025-11-13: GPT-5.1'in Kasım 2025 dondurulmuş sürümü

gpt-5.1-2025-11-13, OpenAI'nin GPT-5.1 serisinin Kasım 2025 tarihli anlık görüntüsüdür. 5.1 sürüm tarihinde bulunduğu haliyle yuvarlanan gpt-5.1 takma adının dondurulmuş hali olup, belirli bir davranışa sabitlenmek isteyen üretim ortamları için kilitlenmiştir.

5.1 değerlendirmesini yapan, üretim iş yüklerini lansman günündeki davranışa karşı doğrulayan ve OpenAI yuvarlanan takma ad üzerinden iyileştirmeler göndermeye devam ederken bu davranışı aynen korumak isteyen ekipler için sabitlenmesi gereken anlık görüntü budur.

Bu anlık görüntü neyi temsil ediyor

Kasım 2025 sürümü, ilk GPT-5.1 dondurulmuş sürümüdür. O sürüm itibarıyla model şunlara sahipti:

  • 5.0'a göre 5.1 iyileştirmelerinin tamamı — geliştirilmiş JSON şema uyumu, daha sıkı araç kullanımı davranışı, sınır durum istemlerinde azaltılmış varyans, rafine edilmiş ret duruşu.
  • Lansman anındaki haliyle 5.1 serisi bağlam penceresi ve dikkat profili.
  • 5.1 serisi standartlarına göre ayarlanmış görsel girdi davranışı.

O tarihten bu yana yuvarlanan gpt-5.1 takma adında biriken şeylere kıyasla bu sürümün sahip olmadıkları:

  • OpenAI'nin lansmandan bu yana gönderdiği sürüm içi iyileştirmeler — küçük doğruluk artışları, ek ret ayarlamaları, gecikme optimizasyonları.
  • Anlık görüntü tarihinden sonra eklenmiş olabilecek yeni API özellikleriyle uyumluluk.

Kasım 2025 lansman davranışına karşı doğrulanmış bir üretim ortamı için, bu sürüm içi güncellemeler tam olarak sabitlemenin sizi koruduğu değişikliklerdir. Ortalamada iyileştirmedirler; ancak değerlendirmenizin etrafında ayarlandığı belirli sınır durumlar için gerileme olabilirler.

Tarihli bir 5.1 sabitlemesi neden mantıklı

Yuvarlanan takma ad yerine GPT-5.1 tarihli anlık görüntüsünü sabitlemenin gerekçesi standart üretim-kararlılık argümanıdır:

  • Sürüm içi güncellemeler arasındaki davranış değişiklikleri, belirli tuhaflıklara göre ayarlanmış istem şablonlarını bozabilir.
  • Şema uyum değişimleri, başlıktaki davranış değişmese bile aşağı akıştaki ayrıştırma sonuçlarını değiştirebilir.
  • Ret duruşu değişimleri, daha önce çalışan senaryolarda ret mesajları üretebilir veya tersi olabilir.
  • Uyumluluk denetimleri genellikle yuvarlanan takma ad kullanımı yerine açık anlık görüntü sabitlemesi ister.

Bedeli, sürüm içi iyileştirmelerden vazgeçmektir. Getirisi, öngörülebilir üretim davranışıdır. Yerleşik kullanıcı tabanı olan, piyasaya sürülmüş ürünler için bu takas genellikle yapmaya değerdir.

Geçiş sorusu

Olgun model serilerinin tarihli anlık görüntüleri için geçiş sorusu iki yöne ayrılır: sürüm içinde ileri (yuvarlanan takma adda biriken her ne ise ona) ve sürümler arası ileri (GPT-5.2'ye veya OpenAI'nin bir sonraki sürdüğü her şeye).

Sürüm içi geçiş genellikle daha düşük riskli yoldur. Aynı model serisi, aynı genel davranış, biriken sürüm içi iyileştirmelerle birlikte. Değerlendirme paketinizi yeniden çalıştırın, sürüm içi güncellemeler kanıtlanabilir biçimde kazandığında geçiş yapın.

Sürümler arası geçiş daha büyük bir değişikliktir. GPT-5.2'nin, sürüm içi sapmanın ötesinde 5.1'den farklılaşan kendine özgü bir davranışı vardır. Yeniden doğrulama daha ağırdır ve 5.2 serisinin kendisi sabitlenecek tarihli anlık görüntülere sahip olana kadar geçiş hedefi hareketli bir hedeftir.

Yetersiz kaldığı yerler

GPT-5 serisinin geri kalanıyla aynı kısıtlamalar.

Maliyet katmanı. Sınır boyutlandırmanın aşırıya kaçtığı iş yükleri için mini ve nano kardeşler doğru seçimdir.

Gecikme. Sınır katmanı gecikmesi, daha küçük kardeşlere göre daha yüksektir.

Ses, gerçek zamanlı ses veya video yok. Özelleşmiş uç noktaları kullanın.

Kendi sunucunuzda çalıştırma mevcut değil.

Codex varyantlarının daha iyi uyum sağladığı kod üretimi ağırlıklı iş yükleri.

Bu tam anlık görüntüyü ne zaman sabitlemeli

Şu durumlarda gpt-5.1-2025-11-13 seçin:

  • Kasım 2025 GPT-5.1 lansman davranışı üzerine bir üretim ürünü piyasaya sürdünüz ve istikrarlı kalmasını istiyorsunuz.
  • Bir uyumluluk gereksinimi model sürümünü anlık görüntü düzeyinde sabitliyor.
  • Sürüm içi güncellemelerin veya GPT-5.2'nin değerlendirmesinin ortasındasınız ve değerlendirme sırasında istikrarlı bir üretim temeline ihtiyacınız var.

Şu durumlarda atlayın:

  • Sıfırdan başlıyorsunuz — yuvarlanan gpt-5.1 takma adı veya gpt-5.1-chat-latest, aktif geliştirme için daha pratik bir varsayılandır.
  • Sürüm içi güncellemeler değerlendirmenizde kanıtlanabilir biçimde kazandı.
  • 5.2 sürümü, ürününüz için önemli olan boyutlarda 5.1'e karşı değerlendirmeyi kazandı.
  • Katalogdaki başka bir model iş yüküne daha iyi uyuyor — maliyet katmanı için mini/nano, kod için codex, ses için ses kardeşleri.

Karşılaştırmaya değer alternatifler

Geçişi yönetmeden sürüm içi güncellemeler istediğinizde yuvarlanan gpt-5.1 takma adı. Yuvarlanan etikete göre optimize edilmiş konuşma kullanım durumları için gpt-5.1-chat-latest. Yeni sürüm değerlendirmesinin kazandığı durumlarda gpt-5.2. Maliyete duyarlı iş yükleri için mini ve nano kardeşler. Kod ağırlıklı işler için codex varyantları.

Dağıtım notları

Standart Chat Completions API. Anlık görüntü sabitlemesi tamamen bir model adı seçimidir; API yüzeyi, görsel girdi davranışı, yapılandırılmış çıktı işleme ve araç kullanımı ergonomisi 5.1'in lansman gününden bu yana değişmemiştir.

Token faturalandırması GPT-5 sınır katmanı oranlarındadır. Anlık görüntü sabitlemesi, yuvarlanan takma ada kıyasla maliyet yapısını değiştirmez.

Pragmatik özet. Bu, GPT-5.1'in Kasım 2025 dondurulmuş sürümüdür. Üretim ürününüz lansman davranışına karşı doğrulandığında ve anlık görüntü düzeyinde istikrar önemli olduğunda bunu sabitleyin. Kendi değerlendirmeniz bir sonraki adımın doğru hamle olduğunu söylediğinde sürüm içinde veya sürümler arasında geçiş yapın. Karar vermeden önce /live-test üzerinden alternatiflerle karşılaştırın.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-5.1-2025-11-13 — illustration 2gpt-5.1-2025-11-13 — illustration 3

Sağlayıcı karşılaştırmasıLIVE

Sağlayıcı karşılaştırması
Bu modeli sunan her sağlayıcıyı karşılaştırın — maliyet temeli, kalite, gecikme ve çalışma süresi.
Azure OpenAI (EU - Sweden)AB
Girdi maliyetien iyi$1.25
Çıktı maliyeti$10.00
KaliteHenüz test edilmedi
Gecikme (p50)Henüz test edilmedi
Çalışma süresiHenüz test edilmedi
Maliyetler 1M token başına (maliyet temeli)
OpenAIABDBu sunum
Girdi maliyeti$1.25
Çıktı maliyeti$10.00
Kaliteen iyi100.0
Gecikme (p50)en iyi1,317 ms
Çalışma süresiHenüz test edilmedi
Maliyetler 1M token başına (maliyet temeli)

Konsensüs zekâsı

MODEL GENELİPASİF

Konsensüs sinyalleri model geneli — henüz sağlayıcı başına ayrılmadı.

Konsensüs puanlaması bu model için hâlâ veri topluyor — henüz sinyal yok.

Topluluk oylarıLIVE

Topluluk oyları
Gerçek ziyaretçiler ne düşünüyor — sağlayıcı başına.
Azure OpenAI (EU - Sweden)AB

Henüz topluluk oyu yok.

OpenAIABD

Henüz topluluk oyu yok.

Daha fazla sonuç — sağlayıcı başına

Kategoriye göre kalite

YaratıcıOlgusalÇok dilliAkıl yürütme

Oyun değerlendirmesi

Henüz veri yok.

Jüri kararı

Tamam 100%Kısmi 0%Yanlış 0%

Oyunlar ve arena

Henüz veri yok.

Hız ve sağlık

1,317 ms

Gecikme (p50)

Çalışma süresi

Soru & cevap — göz atLIVE

1 / 80
🧠 zekâOpenAImultilingual · 2026-07-26puan: 100

Bir mağazada %20 indirim uygulanıyor. 150 TL olan bir ürün indirimden sonra kaç TL olur?

150 TL’lik ürüne %20 indirim: %20’si = 150 × 0,20 = 30 TL İndirimli fiyat = 150 − 30 = **120 TL**

Test geçmişi — tüm sağlayıcılarLIVE

Zaman içinde kalite puanıen son 97
06-2807-26
Hız — zaman içinde p50 gecikme

Bu model birkaç farklı günde test edildiğinde bir trend görünür.