İçeriğe geç
Seviye B — Üretim
Çalıştığı yer:USYapıldığı yer:United States
OpenAI

gpt-5.1-2025-11-13

Seviye B — Üretim

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-5.1-2025-11-13, OpenAI tarafından geliştirilen ve Kasım 2025'te GPT-5 serisinin bir parçası olarak piyasaya sürülen büyük bir dil modelidir. Bu model, OpenAI'ın amiral gemisi dil modeli serisine yönelik yinelemeli bir güncellemeyi temsil eder ve önceki versiyonlara kıyasla mimari iyileştirmeler ile daha güncel veriler üzerinde eğitim içerir. Doğal dil anlama, içerik oluşturma, soru yanıtlama, kod üretimi ve sohbet uygulamaları dahil olmak üzere genel amaçlı metin üretim görevleri için tasarlanmıştır. Model, karmaşık muhakeme, çok turlu diyalog ve talimat takibi desteği ile standart metin üretim yeteneklerine sahiptir. Kesin bağlam penceresi boyutu kamuya açıklanmamış olsa da, modern büyük dil modelleriyle tutarlı şekilde önemli girdi uzunluklarını işleyebileceği beklenmektedir. GPT-5.1, GPT-5 serisi tarafından oluşturulan temel üzerine inşa edilerek muhakeme kıyaslamalarında gelişmiş performans ve eğitim verisi kesim tarihindeki güncellemeler sayesinde iyileştirilmiş olgusal doğruluk sunar. OpenAI'ın model yelpazesinde GPT-5.1-2025-11-13, GPT-5 ailesinde mevcut nesil bir ürün olarak yer alır. Tarih damgalı versiyon tanımlayıcısı, bunun Kasım 2025'te yayınlanan belirli bir anlık görüntü olduğunu gösterir ve OpenAI'ın tutarlılık ve tekrarlanabilirlik için sürümlenmiş yayınlar sağlama uygulamasını yansıtır. Bu model, çeşitli alanlarda üretim uygulamaları, araştırma ve geliştirme için güvenilir, genel amaçlı dil modeli yetenekleri gerektiren kullanıcılara hizmet eder.

GPT-5.1-2025-11-13, OpenAI'ın beşinci nesil dil modeli serisinin güncel sürümü olarak genel amaçlı metin üretimi ve karmaşık muhakeme görevlerinde güçlü bir performans sunuyor.

Tokonomix model değerlendirmesi
Bölüm 01

Hız analizi

Tüm benchmark çalıştırmalarında ölçülen gecikme. P50 (medyan) ve P95 (95. yüzdelik) normal ve yoğun yük altında yanıt hızının gerçekçi bir resmini verir.

P50 gecikme (medyan)P95 gecikme58 runs
435228141265972781708-2209-05ms
Bölüm 02

Kalite puanları

Bu modelin her soru kategorisinde sahanın geri kalanına göre nerede durduğu; aynı sorular üzerinde ikili karşılaştırmayla hesaplanır. Ham jüri puanı her sayının altındadır.

72%
Kod üretimi
jüri ortalaması 99
76%
Yaratıcı
jüri ortalaması 91
62%
Olgusal
jüri ortalaması 87
67%
Çok dilli
jüri ortalaması 100
74%
Akıl yürütme
jüri ortalaması 99

Kategori başına kazanma oranı: bu modelin o kategoriden bir soruda ortalama bir modeli ne sıklıkla yendiği. %50 ortalamadır, kalma notu değildir. Doğru cevap yüzdesi de değildir.

Bölüm 03

Fiyat geçmişi

Milyon token başına doğrudan sağlayıcı tarifeleri, artı tipik bir konuşma maliyet tahmini.

💰
API tarifeleri — gpt-5.1-2025-11-13
$1.25 1M giriş token başına
$10.00 1M çıkış token başına
≈ $0.0028 tipik konuşma başına (800 token)
Giriş vs çıkış fiyatı (1M token başına)
1M giriş token başına$1.25
1M çıkış token başına$10.00

Pricing over time

Input & output per 1M tokens · step-line = price changes

$1.25

input / 1M

— stable

$10.00

output / 1M

— stable

2026-05-242026-07-262026-08-30
Input
Output
Price change
⟳ synced weekly
Bölüm 04

Saniye başına token

Ölçülen P50 gecikmesinden türetilen saniye başına token verimi. Yüksek daha iyidir; dalgalanmalar sağlayıcı tarafındaki yükü yansıtır.

Verim (token / s)315 / avg 292
45574

P50 gecikme × 200 çıkış token tahmininden hesaplandı — mutlak rakam bu varsayıma bağlıdır; önemli olan eğilimdir.

Bölüm 05

Güçlü & zayıf yönler

Benchmark sonuçları ve gerçek kullanım senaryolarına dair toplu topluluk geri bildirimine dayanır.

Güçlü yönler

Güçlü muhakeme yetenekleriÇok turlu diyalog desteğiGeniş kapsamlı metin üretimiKod üretme ve analizTalimat takibi doğruluğuGüncel veri eğitimiSürüm kararlılığı ve tekrarlanabilirlikÇok dilli dil desteği

Zayıf yönler

Bağlam penceresi boyutu belirsizBilgi kesim tarihi sınırlamasıÇoklu modalite desteği belirsizFiyatlandırma katmanı açıklanmamış
Bölüm 06

Yetenekler

toolssource: litellmvisionjson modepdf inputreasoningjson schemaparallel toolsprompt cachingmax output tokens: 128000
Bölüm 07

Sık sorulan sorular

Bağlam penceresi boyutu henüz OpenAI tarafından açıklanmadı. Modern büyük dil modelleriyle tutarlı şekilde önemli miktarda girdi uzunluğu işleyebileceği bekleniyor.

GPT-5 serisinin olgunlaşmış bir temsilcisi olan bu model, üretim ortamlarında tutarlılık ve güvenilirlik arayan ekipler için sağlam bir tercih oluşturuyor.

Tokonomix editör notu
Bölüm 08

Kullanılabilirlik

Kullanılabilirlik

Henüz ölçüm verisi yok

Bu model için kullanılabilirlik istatistiklerini göstermek için yeterli API çağrısı henüz kaydedilmedi. Veri, model canlı trafik almaya başlayınca görünür.

Bölüm 09

Tokonomix kıyaslama kararları

⚖️
Endorsed by 2 judges
Independent LLM judges evaluated this model on our weekly intelligence tests
cohere/command-a100/100 · 1 runs
1 correct0 partial0 wrong100% accuracy
claude-sonnet-4-596/100 · 45 runs
43 correct1 partial1 wrong96% accuracy
2026-08-30

Major capability expansion with tools, vision, and reasoning additions

This release represents a significant evolution from the previous version, introducing eight new capabilities that substantially expand the model's functionality. The addition of tools, vision, and reasoning capabilities marks a fundamental shift in how the model can be deployed. Users now have access to function calling through both single and parallel tool execution, structured output via json_mode and json_schema, PDF document processing, and prompt caching for efficiency gains. These additions transform the model from a text-only system into a multimodal platform capable of handling diverse input types and interaction patterns. While no benchmark performance data is available for this window, the architectural enhancements suggest this version is positioned for more complex, integrated workflows compared to its predecessor. The stability noted in the previous release has given way to expansion, indicating OpenAI's focus on broadening use cases rather than incremental refinement. Users should evaluate these new capabilities against their specific requirements, particularly if visual analysis, structured data extraction, or function-based interactions align with their needs. The absence of performance metrics means real-world testing will be essential to understand how these features perform under production conditions.

Kalite

Gecikme p50

Test çalıştırmaları

0

Eight new capabilities added Vision and PDF support enabled Tool calling with parallel execution Reasoning mode now available
Bölüm 10

Tam model profili

gpt-5.1-2025-11-13 — illustration 1
gpt-5.1-2025-11-13: GPT-5.1'in Kasım 2025 dondurulmuş sürümü

gpt-5.1-2025-11-13, OpenAI'nin GPT-5.1 serisinin Kasım 2025 tarihli anlık görüntüsüdür. 5.1 sürüm tarihinde bulunduğu haliyle yuvarlanan gpt-5.1 takma adının dondurulmuş hali olup, belirli bir davranışa sabitlenmek isteyen üretim ortamları için kilitlenmiştir.

5.1 değerlendirmesini yapan, üretim iş yüklerini lansman günündeki davranışa karşı doğrulayan ve OpenAI yuvarlanan takma ad üzerinden iyileştirmeler göndermeye devam ederken bu davranışı aynen korumak isteyen ekipler için sabitlenmesi gereken anlık görüntü budur.

Bu anlık görüntü neyi temsil ediyor

Kasım 2025 sürümü, ilk GPT-5.1 dondurulmuş sürümüdür. O sürüm itibarıyla model şunlara sahipti:

  • 5.0'a göre 5.1 iyileştirmelerinin tamamı — geliştirilmiş JSON şema uyumu, daha sıkı araç kullanımı davranışı, sınır durum istemlerinde azaltılmış varyans, rafine edilmiş ret duruşu.
  • Lansman anındaki haliyle 5.1 serisi bağlam penceresi ve dikkat profili.
  • 5.1 serisi standartlarına göre ayarlanmış görsel girdi davranışı.

O tarihten bu yana yuvarlanan gpt-5.1 takma adında biriken şeylere kıyasla bu sürümün sahip olmadıkları:

  • OpenAI'nin lansmandan bu yana gönderdiği sürüm içi iyileştirmeler — küçük doğruluk artışları, ek ret ayarlamaları, gecikme optimizasyonları.
  • Anlık görüntü tarihinden sonra eklenmiş olabilecek yeni API özellikleriyle uyumluluk.

Kasım 2025 lansman davranışına karşı doğrulanmış bir üretim ortamı için, bu sürüm içi güncellemeler tam olarak sabitlemenin sizi koruduğu değişikliklerdir. Ortalamada iyileştirmedirler; ancak değerlendirmenizin etrafında ayarlandığı belirli sınır durumlar için gerileme olabilirler.

Tarihli bir 5.1 sabitlemesi neden mantıklı

Yuvarlanan takma ad yerine GPT-5.1 tarihli anlık görüntüsünü sabitlemenin gerekçesi standart üretim-kararlılık argümanıdır:

  • Sürüm içi güncellemeler arasındaki davranış değişiklikleri, belirli tuhaflıklara göre ayarlanmış istem şablonlarını bozabilir.
  • Şema uyum değişimleri, başlıktaki davranış değişmese bile aşağı akıştaki ayrıştırma sonuçlarını değiştirebilir.
  • Ret duruşu değişimleri, daha önce çalışan senaryolarda ret mesajları üretebilir veya tersi olabilir.
  • Uyumluluk denetimleri genellikle yuvarlanan takma ad kullanımı yerine açık anlık görüntü sabitlemesi ister.

Bedeli, sürüm içi iyileştirmelerden vazgeçmektir. Getirisi, öngörülebilir üretim davranışıdır. Yerleşik kullanıcı tabanı olan, piyasaya sürülmüş ürünler için bu takas genellikle yapmaya değerdir.

Geçiş sorusu

Olgun model serilerinin tarihli anlık görüntüleri için geçiş sorusu iki yöne ayrılır: sürüm içinde ileri (yuvarlanan takma adda biriken her ne ise ona) ve sürümler arası ileri (GPT-5.2'ye veya OpenAI'nin bir sonraki sürdüğü her şeye).

Sürüm içi geçiş genellikle daha düşük riskli yoldur. Aynı model serisi, aynı genel davranış, biriken sürüm içi iyileştirmelerle birlikte. Değerlendirme paketinizi yeniden çalıştırın, sürüm içi güncellemeler kanıtlanabilir biçimde kazandığında geçiş yapın.

Sürümler arası geçiş daha büyük bir değişikliktir. GPT-5.2'nin, sürüm içi sapmanın ötesinde 5.1'den farklılaşan kendine özgü bir davranışı vardır. Yeniden doğrulama daha ağırdır ve 5.2 serisinin kendisi sabitlenecek tarihli anlık görüntülere sahip olana kadar geçiş hedefi hareketli bir hedeftir.

Yetersiz kaldığı yerler

GPT-5 serisinin geri kalanıyla aynı kısıtlamalar.

Maliyet katmanı. Sınır boyutlandırmanın aşırıya kaçtığı iş yükleri için mini ve nano kardeşler doğru seçimdir.

Gecikme. Sınır katmanı gecikmesi, daha küçük kardeşlere göre daha yüksektir.

Ses, gerçek zamanlı ses veya video yok. Özelleşmiş uç noktaları kullanın.

Kendi sunucunuzda çalıştırma mevcut değil.

Codex varyantlarının daha iyi uyum sağladığı kod üretimi ağırlıklı iş yükleri.

Bu tam anlık görüntüyü ne zaman sabitlemeli

Şu durumlarda gpt-5.1-2025-11-13 seçin:

  • Kasım 2025 GPT-5.1 lansman davranışı üzerine bir üretim ürünü piyasaya sürdünüz ve istikrarlı kalmasını istiyorsunuz.
  • Bir uyumluluk gereksinimi model sürümünü anlık görüntü düzeyinde sabitliyor.
  • Sürüm içi güncellemelerin veya GPT-5.2'nin değerlendirmesinin ortasındasınız ve değerlendirme sırasında istikrarlı bir üretim temeline ihtiyacınız var.

Şu durumlarda atlayın:

  • Sıfırdan başlıyorsunuz — yuvarlanan gpt-5.1 takma adı veya gpt-5.1-chat-latest, aktif geliştirme için daha pratik bir varsayılandır.
  • Sürüm içi güncellemeler değerlendirmenizde kanıtlanabilir biçimde kazandı.
  • 5.2 sürümü, ürününüz için önemli olan boyutlarda 5.1'e karşı değerlendirmeyi kazandı.
  • Katalogdaki başka bir model iş yüküne daha iyi uyuyor — maliyet katmanı için mini/nano, kod için codex, ses için ses kardeşleri.

Karşılaştırmaya değer alternatifler

Geçişi yönetmeden sürüm içi güncellemeler istediğinizde yuvarlanan gpt-5.1 takma adı. Yuvarlanan etikete göre optimize edilmiş konuşma kullanım durumları için gpt-5.1-chat-latest. Yeni sürüm değerlendirmesinin kazandığı durumlarda gpt-5.2. Maliyete duyarlı iş yükleri için mini ve nano kardeşler. Kod ağırlıklı işler için codex varyantları.

Dağıtım notları

Standart Chat Completions API. Anlık görüntü sabitlemesi tamamen bir model adı seçimidir; API yüzeyi, görsel girdi davranışı, yapılandırılmış çıktı işleme ve araç kullanımı ergonomisi 5.1'in lansman gününden bu yana değişmemiştir.

Token faturalandırması GPT-5 sınır katmanı oranlarındadır. Anlık görüntü sabitlemesi, yuvarlanan takma ada kıyasla maliyet yapısını değiştirmez.

Pragmatik özet. Bu, GPT-5.1'in Kasım 2025 dondurulmuş sürümüdür. Üretim ürününüz lansman davranışına karşı doğrulandığında ve anlık görüntü düzeyinde istikrar önemli olduğunda bunu sabitleyin. Kendi değerlendirmeniz bir sonraki adımın doğru hamle olduğunu söylediğinde sürüm içinde veya sürümler arasında geçiş yapın. Karar vermeden önce /live-test üzerinden alternatiflerle karşılaştırın.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-5.1-2025-11-13 — illustration 2gpt-5.1-2025-11-13 — illustration 3
Son otomatik test
5 Eyl 2026 · 08:01 UTC · Hız testi
P50 gecikme
635 ms
P95 gecikme
973 ms
Hatalar
0 / 6 çalıştırma
Son inceleyen Tokonomix Ekibi·26 Mayıs 2026