İçeriğe geç
Seviye B — Üretim
Çalıştığı yer:USYapıldığı yer:United States
OpenAI

gpt-5.1-2025-11-13

Seviye B — Üretim

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-5.1-2025-11-13, OpenAI tarafından geliştirilen ve Kasım 2025'te GPT-5 serisinin bir parçası olarak piyasaya sürülen büyük bir dil modelidir. Bu model, OpenAI'ın amiral gemisi dil modeli serisine yönelik yinelemeli bir güncellemeyi temsil eder ve önceki versiyonlara kıyasla mimari iyileştirmeler ile daha güncel veriler üzerinde eğitim içerir. Doğal dil anlama, içerik oluşturma, soru yanıtlama, kod üretimi ve sohbet uygulamaları dahil olmak üzere genel amaçlı metin üretim görevleri için tasarlanmıştır. Model, karmaşık muhakeme, çok turlu diyalog ve talimat takibi desteği ile standart metin üretim yeteneklerine sahiptir. Kesin bağlam penceresi boyutu kamuya açıklanmamış olsa da, modern büyük dil modelleriyle tutarlı şekilde önemli girdi uzunluklarını işleyebileceği beklenmektedir. GPT-5.1, GPT-5 serisi tarafından oluşturulan temel üzerine inşa edilerek muhakeme kıyaslamalarında gelişmiş performans ve eğitim verisi kesim tarihindeki güncellemeler sayesinde iyileştirilmiş olgusal doğruluk sunar. OpenAI'ın model yelpazesinde GPT-5.1-2025-11-13, GPT-5 ailesinde mevcut nesil bir ürün olarak yer alır. Tarih damgalı versiyon tanımlayıcısı, bunun Kasım 2025'te yayınlanan belirli bir anlık görüntü olduğunu gösterir ve OpenAI'ın tutarlılık ve tekrarlanabilirlik için sürümlenmiş yayınlar sağlama uygulamasını yansıtır. Bu model, çeşitli alanlarda üretim uygulamaları, araştırma ve geliştirme için güvenilir, genel amaçlı dil modeli yetenekleri gerektiren kullanıcılara hizmet eder.

GPT-5.1-2025-11-13, OpenAI'ın beşinci nesil dil modeli serisinin güncel sürümü olarak genel amaçlı metin üretimi ve karmaşık muhakeme görevlerinde güçlü bir performans sunuyor.

Tokonomix model değerlendirmesi
Bölüm 01

Hız analizi

Tüm benchmark çalıştırmalarında ölçülen gecikme. P50 (medyan) ve P95 (95. yüzdelik) normal ve yoğun yük altında yanıt hızının gerçekçi bir resmini verir.

P50 gecikme (medyan)P95 gecikme97 runs
435228141265972781708-2209-15ms
Bölüm 02

Kalite puanları

Bu modelin her soru kategorisinde sahanın geri kalanına göre nerede durduğu; aynı sorular üzerinde ikili karşılaştırmayla hesaplanır. Ham jüri puanı her sayının altındadır.

75%
Kod üretimi
jüri ortalaması 99
73%
Yaratıcı
jüri ortalaması 87
59%
Olgusal
jüri ortalaması 80
64%
Çok dilli
jüri ortalaması 99
74%
Akıl yürütme
jüri ortalaması 99

Kategori başına kazanma oranı: bu modelin o kategoriden bir soruda ortalama bir modeli ne sıklıkla yendiği. %50 ortalamadır, kalma notu değildir. Doğru cevap yüzdesi de değildir.

Bölüm 03

Fiyatlar

Bu modeli Tokonomix üzerinden kullandığınızda milyon token başına ödediğiniz tutar ve tipik bir konuşma için tahmini maliyet.

💰
API tarifeleri — gpt-5.1-2025-11-13
$1.63 1M giriş token başına
$13.00 1M çıkış token başına
≈ $0.0036 tipik konuşma başına (800 token)
Giriş vs çıkış fiyatı (1M token başına)
1M giriş token başına$1.63
1M çıkış token başına$13.00
Bölüm 04

Saniye başına token

Ölçülen P50 gecikmesinden türetilen saniye başına token verimi. Yüksek daha iyidir; dalgalanmalar sağlayıcı tarafındaki yükü yansıtır.

Verim (token / s)341 / avg 292
45574

P50 gecikme × 200 çıkış token tahmininden hesaplandı — mutlak rakam bu varsayıma bağlıdır; önemli olan eğilimdir.

Bölüm 05

Güçlü & zayıf yönler

Benchmark sonuçları ve gerçek kullanım senaryolarına dair toplu topluluk geri bildirimine dayanır.

Güçlü yönler

Güçlü muhakeme yetenekleriÇok turlu diyalog desteğiGeniş kapsamlı metin üretimiKod üretme ve analizTalimat takibi doğruluğuGüncel veri eğitimiSürüm kararlılığı ve tekrarlanabilirlikÇok dilli dil desteği

Zayıf yönler

Bağlam penceresi boyutu belirsizBilgi kesim tarihi sınırlamasıÇoklu modalite desteği belirsizFiyatlandırma katmanı açıklanmamış
Bölüm 06

Yetenekler

toolssource: litellmvisionjson modepdf inputreasoningjson schemaparallel toolsprompt cachingmax output tokens: 128000
Bölüm 07

Sık sorulan sorular

Bağlam penceresi boyutu henüz OpenAI tarafından açıklanmadı. Modern büyük dil modelleriyle tutarlı şekilde önemli miktarda girdi uzunluğu işleyebileceği bekleniyor.

GPT-5 serisinin olgunlaşmış bir temsilcisi olan bu model, üretim ortamlarında tutarlılık ve güvenilirlik arayan ekipler için sağlam bir tercih oluşturuyor.

Tokonomix editör notu
Bölüm 08

Kullanılabilirlik

Kullanılabilirlik

Henüz ölçüm verisi yok

Bu model için kullanılabilirlik istatistiklerini göstermek için yeterli API çağrısı henüz kaydedilmedi. Veri, model canlı trafik almaya başlayınca görünür.

Bölüm 09

Tokonomix kıyaslama kararları

⚖️
Endorsed by 2 judges
Independent LLM judges evaluated this model on our weekly intelligence tests
cohere/command-a100/100 · 1 runs
1 correct0 partial0 wrong100% accuracy
claude-sonnet-4-594/100 · 55 runs
51 correct2 partial2 wrong93% accuracy
2026-09-13

Quality dip and major latency regression offset by perfect code performance

This benchmark window reveals a mixed performance profile for GPT-5.1. The model demonstrates exceptional coding capabilities with a perfect 100 score, maintaining the strong performance from the previous window. Reasoning also achieved a perfect 100, suggesting robust logical processing abilities. However, the overall quality score declined from 85.1 to 83.8, driven primarily by a significant drop in factual accuracy to just 52 points. This represents a concerning regression in knowledge retrieval and factual correctness that users should be aware of when deploying the model for information-intensive tasks. The most notable change is a 72% increase in latency, with the median response time jumping from 1779ms to 3054ms. This substantial slowdown may impact user experience in latency-sensitive applications. The previous window showed strong creative and multilingual performance, but these categories were not evaluated in the current testing cycle, making direct comparison impossible. Users should expect excellent performance for programming and logical reasoning tasks, but exercise caution with factual queries and be prepared for slower response times compared to the previous release.

Kalite

83.8

Gecikme p50

3,054 ms

Test çalıştırmaları

5

Perfect coding score achieved Reasoning capabilities at maximum Factual accuracy dropped to 52 Latency increased 72 percent
Bölüm 10

Tam model profili

gpt-5.1-2025-11-13 — illustration 1
gpt-5.1-2025-11-13: GPT-5.1'in Kasım 2025 dondurulmuş sürümü

gpt-5.1-2025-11-13, OpenAI'nin GPT-5.1 serisinin Kasım 2025 tarihli anlık görüntüsüdür. 5.1 sürüm tarihinde bulunduğu haliyle yuvarlanan gpt-5.1 takma adının dondurulmuş hali olup, belirli bir davranışa sabitlenmek isteyen üretim ortamları için kilitlenmiştir.

5.1 değerlendirmesini yapan, üretim iş yüklerini lansman günündeki davranışa karşı doğrulayan ve OpenAI yuvarlanan takma ad üzerinden iyileştirmeler göndermeye devam ederken bu davranışı aynen korumak isteyen ekipler için sabitlenmesi gereken anlık görüntü budur.

Bu anlık görüntü neyi temsil ediyor

Kasım 2025 sürümü, ilk GPT-5.1 dondurulmuş sürümüdür. O sürüm itibarıyla model şunlara sahipti:

  • 5.0'a göre 5.1 iyileştirmelerinin tamamı — geliştirilmiş JSON şema uyumu, daha sıkı araç kullanımı davranışı, sınır durum istemlerinde azaltılmış varyans, rafine edilmiş ret duruşu.
  • Lansman anındaki haliyle 5.1 serisi bağlam penceresi ve dikkat profili.
  • 5.1 serisi standartlarına göre ayarlanmış görsel girdi davranışı.

O tarihten bu yana yuvarlanan gpt-5.1 takma adında biriken şeylere kıyasla bu sürümün sahip olmadıkları:

  • OpenAI'nin lansmandan bu yana gönderdiği sürüm içi iyileştirmeler — küçük doğruluk artışları, ek ret ayarlamaları, gecikme optimizasyonları.
  • Anlık görüntü tarihinden sonra eklenmiş olabilecek yeni API özellikleriyle uyumluluk.

Kasım 2025 lansman davranışına karşı doğrulanmış bir üretim ortamı için, bu sürüm içi güncellemeler tam olarak sabitlemenin sizi koruduğu değişikliklerdir. Ortalamada iyileştirmedirler; ancak değerlendirmenizin etrafında ayarlandığı belirli sınır durumlar için gerileme olabilirler.

Tarihli bir 5.1 sabitlemesi neden mantıklı

Yuvarlanan takma ad yerine GPT-5.1 tarihli anlık görüntüsünü sabitlemenin gerekçesi standart üretim-kararlılık argümanıdır:

  • Sürüm içi güncellemeler arasındaki davranış değişiklikleri, belirli tuhaflıklara göre ayarlanmış istem şablonlarını bozabilir.
  • Şema uyum değişimleri, başlıktaki davranış değişmese bile aşağı akıştaki ayrıştırma sonuçlarını değiştirebilir.
  • Ret duruşu değişimleri, daha önce çalışan senaryolarda ret mesajları üretebilir veya tersi olabilir.
  • Uyumluluk denetimleri genellikle yuvarlanan takma ad kullanımı yerine açık anlık görüntü sabitlemesi ister.

Bedeli, sürüm içi iyileştirmelerden vazgeçmektir. Getirisi, öngörülebilir üretim davranışıdır. Yerleşik kullanıcı tabanı olan, piyasaya sürülmüş ürünler için bu takas genellikle yapmaya değerdir.

Geçiş sorusu

Olgun model serilerinin tarihli anlık görüntüleri için geçiş sorusu iki yöne ayrılır: sürüm içinde ileri (yuvarlanan takma adda biriken her ne ise ona) ve sürümler arası ileri (GPT-5.2'ye veya OpenAI'nin bir sonraki sürdüğü her şeye).

Sürüm içi geçiş genellikle daha düşük riskli yoldur. Aynı model serisi, aynı genel davranış, biriken sürüm içi iyileştirmelerle birlikte. Değerlendirme paketinizi yeniden çalıştırın, sürüm içi güncellemeler kanıtlanabilir biçimde kazandığında geçiş yapın.

Sürümler arası geçiş daha büyük bir değişikliktir. GPT-5.2'nin, sürüm içi sapmanın ötesinde 5.1'den farklılaşan kendine özgü bir davranışı vardır. Yeniden doğrulama daha ağırdır ve 5.2 serisinin kendisi sabitlenecek tarihli anlık görüntülere sahip olana kadar geçiş hedefi hareketli bir hedeftir.

Yetersiz kaldığı yerler

GPT-5 serisinin geri kalanıyla aynı kısıtlamalar.

Maliyet katmanı. Sınır boyutlandırmanın aşırıya kaçtığı iş yükleri için mini ve nano kardeşler doğru seçimdir.

Gecikme. Sınır katmanı gecikmesi, daha küçük kardeşlere göre daha yüksektir.

Ses, gerçek zamanlı ses veya video yok. Özelleşmiş uç noktaları kullanın.

Kendi sunucunuzda çalıştırma mevcut değil.

Codex varyantlarının daha iyi uyum sağladığı kod üretimi ağırlıklı iş yükleri.

Bu tam anlık görüntüyü ne zaman sabitlemeli

Şu durumlarda gpt-5.1-2025-11-13 seçin:

  • Kasım 2025 GPT-5.1 lansman davranışı üzerine bir üretim ürünü piyasaya sürdünüz ve istikrarlı kalmasını istiyorsunuz.
  • Bir uyumluluk gereksinimi model sürümünü anlık görüntü düzeyinde sabitliyor.
  • Sürüm içi güncellemelerin veya GPT-5.2'nin değerlendirmesinin ortasındasınız ve değerlendirme sırasında istikrarlı bir üretim temeline ihtiyacınız var.

Şu durumlarda atlayın:

  • Sıfırdan başlıyorsunuz — yuvarlanan gpt-5.1 takma adı veya gpt-5.1-chat-latest, aktif geliştirme için daha pratik bir varsayılandır.
  • Sürüm içi güncellemeler değerlendirmenizde kanıtlanabilir biçimde kazandı.
  • 5.2 sürümü, ürününüz için önemli olan boyutlarda 5.1'e karşı değerlendirmeyi kazandı.
  • Katalogdaki başka bir model iş yüküne daha iyi uyuyor — maliyet katmanı için mini/nano, kod için codex, ses için ses kardeşleri.

Karşılaştırmaya değer alternatifler

Geçişi yönetmeden sürüm içi güncellemeler istediğinizde yuvarlanan gpt-5.1 takma adı. Yuvarlanan etikete göre optimize edilmiş konuşma kullanım durumları için gpt-5.1-chat-latest. Yeni sürüm değerlendirmesinin kazandığı durumlarda gpt-5.2. Maliyete duyarlı iş yükleri için mini ve nano kardeşler. Kod ağırlıklı işler için codex varyantları.

Dağıtım notları

Standart Chat Completions API. Anlık görüntü sabitlemesi tamamen bir model adı seçimidir; API yüzeyi, görsel girdi davranışı, yapılandırılmış çıktı işleme ve araç kullanımı ergonomisi 5.1'in lansman gününden bu yana değişmemiştir.

Token faturalandırması GPT-5 sınır katmanı oranlarındadır. Anlık görüntü sabitlemesi, yuvarlanan takma ada kıyasla maliyet yapısını değiştirmez.

Pragmatik özet. Bu, GPT-5.1'in Kasım 2025 dondurulmuş sürümüdür. Üretim ürününüz lansman davranışına karşı doğrulandığında ve anlık görüntü düzeyinde istikrar önemli olduğunda bunu sabitleyin. Kendi değerlendirmeniz bir sonraki adımın doğru hamle olduğunu söylediğinde sürüm içinde veya sürümler arasında geçiş yapın. Karar vermeden önce /live-test üzerinden alternatiflerle karşılaştırın.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-5.1-2025-11-13 — illustration 2gpt-5.1-2025-11-13 — illustration 3
Son otomatik test
15 Eyl 2026 · 02:05 UTC · Hız testi
P50 gecikme
587 ms
P95 gecikme
715 ms
Hatalar
0 / 6 çalıştırma
Son inceleyen Tokonomix Ekibi·26 Mayıs 2026