İçeriğe geç
Seviye C — Uzman
Çalıştığı yer:USYapıldığı yer:United States

Kullanımdan kaldırma tarihi

Sağlayıcı bu modeli 23 Ekim 2026 tarihinde kullanımdan kaldıracak. O zamana kadar her zamanki gibi çalışır.

OpenAI

gpt-3.5-turbo-0125

Seviye C — Uzman

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GPT-3.5-turbo-0125, OpenAI tarafından geliştirilen ve Ocak 2024'te GPT-3.5-turbo serisine kademeli bir güncelleme olarak piyasaya sürülen büyük bir dil modelidir. Bu model, OpenAI'nin Generative Pre-trained Transformer teknolojisine dayanan GPT-3.5-turbo mimarisinin anlık görüntü versiyonunu temsil eder. Konuşma, içerik oluşturma, özetleme, analiz ve kodlama yardımı dahil olmak üzere genel amaçlı metin oluşturma görevleri için tasarlanmıştır. Model, metin girişlerini işler ve çeşitli internet metin verileri üzerinde eğitim sırasında öğrenilen kalıplara dayalı olarak insansı yanıtlar üretir. Model, önceki GPT-3.5 versiyonlarına kıyasla iyileştirilmiş doğruluk ve azaltılmış halüsinasyon oranlarıyla standart metin oluşturma yeteneklerini destekler. OpenAI tarafından tam bağlam penceresi boyutu kamuya açıklanmamış olsa da, GPT-3.5-turbo modelleri genellikle birkaç bin token bağlam işler. 0125 tanımlaması, bunun sürekli güncellenen GPT-3.5-turbo uç noktası gibi devam eden güncellemelere tabi olmak yerine, davranışının zaman içinde tutarlı kaldığı istikrarlı bir anlık görüntü versiyonu olduğunu gösterir. OpenAI'nin model yelpazesi içinde GPT-3.5-turbo-0125, eski GPT-3 modelleri ile daha gelişmiş GPT-4 serisi arasında orta düzey bir seçenek olarak yer alır. Yetenek ve verimlilik dengesi sunarak, daha büyük modellerin hesaplama yükü olmadan standart doğal dil görevlerinde güvenilir performans gerektiren uygulamalar için uygundur. Model, OpenAI'nin API'si aracılığıyla erişilebilir ve konuşma yapay zeka uygulamaları ile otomatik metin işleme sistemleri geliştiren geliştiriciler için pratik bir seçenek olarak hizmet verir.

GPT-3.5-turbo-0125, OpenAI'nin Ocak 2024'te piyasaya sürdüğü sabit sürüm modeli olarak, güvenilir performans ve tutarlı davranış arayan geliştiriciler için pragmatik bir seçim sunuyor.

Tokonomix model değerlendirme özeti
Bölüm 01

Hız analizi

Tüm benchmark çalıştırmalarında ölçülen gecikme. P50 (medyan) ve P95 (95. yüzdelik) normal ve yoğun yük altında yanıt hızının gerçekçi bir resmini verir.

P50 gecikme (medyan)P95 gecikme96 runs
368146525613658475408-2209-14ms
Bölüm 02

Kalite puanları

Bu modelin her soru kategorisinde sahanın geri kalanına göre nerede durduğu; aynı sorular üzerinde ikili karşılaştırmayla hesaplanır. Ham jüri puanı her sayının altındadır.

58%
Kod üretimi
jüri ortalaması 96
46%
Yaratıcı
jüri ortalaması 90
18%
Olgusal
jüri ortalaması 55
51%
Çok dilli
jüri ortalaması 92
43%
Akıl yürütme
jüri ortalaması 83
25%
Sağlık
jüri ortalaması 68

Kategori başına kazanma oranı: bu modelin o kategoriden bir soruda ortalama bir modeli ne sıklıkla yendiği. %50 ortalamadır, kalma notu değildir. Doğru cevap yüzdesi de değildir.

Bölüm 03

Fiyatlar

Bu modeli Tokonomix üzerinden kullandığınızda milyon token başına ödediğiniz tutar ve tipik bir konuşma için tahmini maliyet.

💰
API tarifeleri — gpt-3.5-turbo-0125
$0.9800 1M giriş token başına
$2.93 1M çıkış token başına
≈ $0.0012 tipik konuşma başına (800 token)
Giriş vs çıkış fiyatı (1M token başına)
1M giriş token başına$0.9800
1M çıkış token başına$2.93
Bölüm 04

Saniye başına token

Ölçülen P50 gecikmesinden türetilen saniye başına token verimi. Yüksek daha iyidir; dalgalanmalar sağlayıcı tarafındaki yükü yansıtır.

Verim (token / s)339 / avg 295
53852

P50 gecikme × 200 çıkış token tahmininden hesaplandı — mutlak rakam bu varsayıma bağlıdır; önemli olan eğilimdir.

Bölüm 05

Güçlü & zayıf yönler

Benchmark sonuçları ve gerçek kullanım senaryolarına dair toplu topluluk geri bildirimine dayanır.

Güçlü yönler

Sabit sürüm garantisiAzaltılmış halüsinasyon oranıGüçlü konuşma yetenekleriHızlı yanıt süreleriKod yazma desteğiEtkili metin özetlemeAPI ile kolay entegrasyonKapasite-maliyet dengesi

Zayıf yönler

GPT-4'e göre sınırlı muhakemeBilgi kesme tarihi sınırlamasıGörsel işleme yokKarmaşık analizlerde yetersiz kalabilir
Bölüm 06

Yetenekler

toolssource: litellmparallel toolsprompt cachingmax output tokens: 4096
Bölüm 07

Sık sorulan sorular

GPT-3.5-turbo sürekli güncellenen bir endpoint iken, 0125 sabit bir anlık görüntü sürümüdür. 0125, zaman içinde tutarlı davranış garantisi verir ve üretim ortamlarında öngörülebilirlik sağlar.

Halüsinasyon oranlarındaki iyileştirmeler ve sabit sürüm garantisi, bu modeli üretim ortamları için güvenli bir tercih haline getiriyor. GPT-4 serisine kıyasla daha erişilebilir bir alternatif arayan ekipler için dengeli bir çözüm.

Tokonomix editoryal değerlendirme
Bölüm 08

Kullanılabilirlik

Kullanılabilirlik

Henüz ölçüm verisi yok

Bu model için kullanılabilirlik istatistiklerini göstermek için yeterli API çağrısı henüz kaydedilmedi. Veri, model canlı trafik almaya başlayınca görünür.

Bölüm 09

Tokonomix kıyaslama kararları

⚖️
Endorsed by 2 judges
Independent LLM judges evaluated this model on our weekly intelligence tests
cohere/command-a100/100 · 1 runs
1 correct0 partial0 wrong100% accuracy
claude-sonnet-4-582/100 · 145 runs
100 correct20 partial25 wrong69% accuracy
2026-09-13

Significant quality degradation and latency regression across categories

The gpt-3.5-turbo-0125 model has experienced a substantial decline in performance this benchmark window. Overall quality dropped 33.4 points from 83.1 to 49.7, representing a significant regression in capabilities. Latency has deteriorated considerably, with p50 response times increasing 74% from 1206ms to 2099ms, indicating slower processing across the board. Category performance shows mixed but concerning results. Coding capabilities remain strong at 96, maintaining the high standard from the previous window's 94 score. However, factual accuracy has collapsed to just 8 points, a dramatic departure from previous performance levels. Reasoning capabilities settled at a mediocre 45, well below the model's historical standards. The multilingual and creative categories from the previous window were not tested in this period, making direct comparison incomplete. The severe drop in factual performance is particularly noteworthy and may indicate issues with knowledge retrieval or response generation. Combined with the substantial latency increase, users should expect noticeably degraded experience compared to the previous benchmark period. The maintained coding performance provides the only bright spot in an otherwise concerning update that warrants investigation into what changed in the model deployment or infrastructure.

Kalite

49.7

Gecikme p50

2,099 ms

Test çalıştırmaları

5

Quality dropped 33.4 points Latency increased 74% Factual accuracy collapsed to 8 Coding performance remains strong
Bölüm 10

Tam model profili

gpt-3.5-turbo-0125 — illustration 1

⚠️ Kullanımdan kaldırılmış model. OpenAI bu modeli emekliye ayırdı. Yeni projeler için, maliyet-verimli genel kullanım için GPT-4o mini veya daha güçlü akıl yürütme için GPT-4.1 modellerine bakın. Mevcut entegrasyonlar, API uç noktası kapanmadan önce geçişi planlamalıdır.

gpt-3.5-turbo-0125: Ocak 2024 güncellemesi

gpt-3.5-turbo-0125, 25 Ocak 2024'te yayınlanan GPT-3.5 Turbo'nun tarihli anlık görüntüsüdür. 3.5 hattındaki son anlamlı yetenek güncellemesiydi — daha keskin talimat takibi, JSON modundaki tuhaflıkların giderilmesi ve modelin uç durumlarda daha öngörülebilir davranmasını sağlayan tokenizer iyileştirmeleri.

Şu anda emekliye ayrılmış durumda. Sabitlenmiş tanımlayıcı bugün hâlâ çözümleniyor ancak kullanımdan kaldırma ufku sonludur ve yeni projeler bunu hedeflememelidir.

Bu sürümde neler değişti

OpenAI'nin Ocak 2024 notlarındaki başlık talimat takibiydi. Önceki 3.5 anlık görüntüleri, talimatları yerine getirmek yerine yeniden ifade etme alışkanlığına sahipti — model bir isteği kabul ediyor ve ardından istemin gerçekten sorduğundan farklı bir cevaba doğru sürükleniyordu. 0125 sürümü bunu önemli ölçüde sıkılaştırdı.

3.5'i üretimde çalıştıran ekipler için talimat takibi iyileştirmesi, kıyaslama puanlarında görünmeyen ama kendi istemlerinize karşı yapılan değerlendirme puanlarında görünen türden bir yükseltmeydi. Aynı görev tanımı daha temiz çıktı üretiyordu ve önceki anlık görüntülere karşı yazılmış istem katmanı geçici çözümleri çoğu zaman emekliye ayrılabilirdi.

JSON modu diğer sessiz düzeltmeydi. Önceki 3.5 anlık görüntüleri çoğunlukla geçerli ama belirli köşe durumlarda zaman zaman bozuk JSON üretiyordu — dizilerde sondaki virgüller, yük altında eksik kapatma süslü parantezleri, iç içe dizelerin tutarsız kaçışları. 0125 sürümü, bunların aşağı akış ayrıştırıcılarının bir veya iki defansif işlem katmanını bırakabilmesine yetecek kadarını düzeltti.

Maliyet profili 3.5 hattının geri kalanının bulunduğu yerde kaldı; o zamanlar bu iyileştirmeleri ilginç kılan da buydu. Aynı fiyat, daha iyi davranış.

Bozuk kalanlar

Akıl yürütme derinliği. 0125 hâlâ 3.5 sınıfı bir modeldi. Gerçek çıkarım zincirleme, yeni kod sentezi, yoğun mantık bulmacaları gerektiren çok adımlı istemler — hepsi GPT-4'ün halihazırda sunduğundan görünür şekilde daha zayıftı. Talimat takibi düzeltmesi modeli daha güvenilir hale getirdi; modeli derin bir anlamda daha akıllı yapmadı.

Olgusallık. Halüsinasyonlar yapısal bir şekilde ele alınmadı. Model, istem yanıtı içermediğinde hâlâ kendinden emin cevaplar uyduruyordu. Herhangi bir olgusal yolda hâlâ getirme destekli üretim veya insan incelemesi gerekiyordu.

Reddetme kalibrasyonu. Önceki anlık görüntülere göre biraz daha tutarlı, ancak zararsız istemleri reddetme ve sınır modellerin geri iteceği uç durum istemlerine uyma örüntüsü devam etti.

Ekipler neden 0125'e sabitlediler

2024'ün büyük bölümünde, 3.5 maliyet-verimli varsayılan olduğunda, ekiplerin sabitlediği anlık görüntü buydu. Üç sebep.

Birincisi, "en son kararlı 3.5." Tekrarlanabilirlik gerektiren üretim dağıtımları, bilinen en az tuhaflığa sahip modeli istiyordu; 0125 en yeni ve en az bozuk seçenekti.

İkincisi, aşağı akış boru hatları 0125 davranışına göre ayarlanmıştı. Bir kez bir ayrıştırıcı, bir CI test paketi veya ince ayarlı bir aşağı akış sınıflandırıcısı bu anlık görüntüye karşı oluşturulduğunda, daha yeni bir anlık görüntüye karşı yeniden ayarlama maliyeti gerçekti. Sabitleme bu yatırımı koruyordu.

Üçüncüsü, düzenlenmiş iş akışları bu tanımlayıcıya karşı onaylanmıştı. Bazı uyumluluk incelemeleri özellikle 0125'e karşı tamamlanmıştı ve yeni bir denetim döngüsü olmadan farklı bir anlık görüntüye geçemiyordu.

3.5 ailesinin kullanımdan kaldırıldığı şu dönemde her üç sebep de kötü yaşlandı. Geçiş hedefi artık farklı bir 3.5 anlık görüntüsü değil.

Bugünkü geçiş

0125 anlık görüntüsü, orijinal 3.5 sürümünden daha yenidir ve geçiş hesabı, orijinal Turbo'dan geçişten biraz farklıdır.

Talimat takibi iyileştirmeleri için özellikle 0125'e sabitlediyseniz, davranışsal olarak en yakın geçiş GPT-4o mini modelidir. Gecikme süresi karşılaştırılabilir, API yüzeyi aynı, talimat takibi anlamlı şekilde daha güçlü.

Aşağı akış boru hattınız 0125'in spesifik JSON modu davranışına bağımlıysa, Ağustos 2024 ve sonrasındaki GPT-4o anlık görüntülerindeki ve GPT-4.1 ailesindeki yapılandırılmış çıktılar özelliği daha güvenilir bir yedektir. Aşağı akış ayrıştırıcısını yeniden ayarlamanız gerekebilir; büyük resim şudur ki katı şema zorlaması, istem mühendisliği hilelerinin etrafından dolaştığı başarısızlık modlarını ortadan kaldırır.

Akıl yürütme şeklindeki iş yükünüz zaten 0125'i tavanının ötesine itiyorsa, gpt-4.1-mini veya tam GPT-4.1 modeline geçiş daha büyük bir sıçramadır ancak iş yükünüze uyan budur.

Bugün ne yapmalı

0125 hâlâ yığınınızda ise:

Birincisi, iş yükünü denetleyin. 3.5 ailesi 2024 dönemi üretim trafiğinin büyük bir kısmı için yeterince iyiydi; soru, spesifik iş yükünüzün hâlâ bu sabitlemeden faydalanıp faydalanmadığı veya bir yıl önce yukarı taşınması gerekip gerekmediğidir.

İkincisi, aday geçiş hedefinize karşı gerçek bir değerlendirme çalıştırın. Daha yeni modeller genellikle farklı istemler gerektirir ve 0125 döneminden kalan istem mühendisliğini taşımak, bir halefin olduğundan daha kötü görünmesine neden olabilir.

Üçüncüsü, kullanımdan kaldırma e-postası gelmeden geçişi planlayın. 3.5 ailesi sonlu bir takvimde. Sabitlenmiş bir 3.5 anlık görüntüsü üzerindeki üretim trafiği bilinen bir risktir; bilinen bir risk, kendi zaman çizelgenizde azaltabileceğiniz bir risktir.

Kategoriler arası karşılaştırma için bkz. /benchmarks/leaderboard.

Seçim

Yeni yapımlar için bu anlık görüntüyü seçmeyin. 3.5 ailesi kullanımdan kaldırıldı ve sabitlenmiş tanımlayıcılar sonunda kapanacak.

Mevcut entegrasyonlar için geçişi planlayın. 0125 şekilli iş yükleri için davranışsal olarak en benzer halef GPT-4o mini'dir; ileriye dönük hamle ise GPT-4.1 ailesidir. Her iki durumda da geçiş, OpenAI'nin kullanımdan kaldırma takvimine göre değil, kendi sürüm takviminize göre gerçekleşmelidir.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

gpt-3.5-turbo-0125 — illustration 2gpt-3.5-turbo-0125 — illustration 3
Son otomatik test
14 Eyl 2026 · 20:04 UTC · Hız testi
P50 gecikme
590 ms
P95 gecikme
777 ms
Hatalar
0 / 6 çalıştırma
Son inceleyen Tokonomix Ekibi·26 Mayıs 2026