İçeriğe geç
Seviye C — Uzman
Çalıştığı yer:USYapıldığı yer:United States

Kullanımdan kaldırma tarihi

Sağlayıcı bu modeli 23 Ekim 2026 tarihinde kullanımdan kaldıracak. O zamana kadar her zamanki gibi çalışır.

OpenAI

o1-2024-12-17

Seviye C — Uzman

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

o1-2024-12-17, OpenAI tarafından geliştirilen ve Aralık 2024'te o1 serisinin bir parçası olarak yayınlanan büyük bir dil modelidir. Bu model, yanıt üretmeden önce uzun süreli akıl yürütme yapmak üzere tasarlanmış olup karmaşık problem çözme görevlerinde daha fazla hesaplama eforu harcamasını sağlayan pekiştirmeli öğrenme tekniklerini kullanır. İleri düzey matematik, kodlama, bilimsel analiz ve mantıksal çıkarım gibi çok adımlı akıl yürütme gerektiren uygulamalar için özellikle uygundur. Model, dahili olarak yapılandırılmış düşünce zincirleri üretir; ancak bu akıl yürütme izleri standart arayüzde kullanıcılara gösterilmez. o1-2024-12-17 sürümü, o1-preview ve o1-mini gibi önceki sürümlerin ardından OpenAI'nin o1 ailesi içindeki bir evrimi temsil eder. Standart metin üretme işlevini korurken seleflerine kıyasla geliştirilmiş akıl yürütme yetenekleri ve doğruluk sunar. Model şu anda görüntü işleme veya işlev çağırma gibi gelişmiş çok modlu girdileri desteklememekte; bunun yerine metin tabanlı akıl yürütme ve üretme görevlerine odaklanmaktadır. Bağlam penceresi boyutu, yayınlanma tarihinde kamuya açıklanmamıştır. OpenAI'nin model yelpazesinde o1-2024-12-17, genel amaçlı GPT-4 serisinden ayrışan, akıl yürütme odaklı uzmanlaşmış bir konumda yer alır. Hız veya konuşma akıcılığından çok analiz derinliğinin ve doğruluğun önceliklendirildiği kullanım senaryoları için tasarlanmıştır. Kullanıcılar bu modeli genellikle hızlı yanıt üretiminden ziyade özenli ve yapılandırılmış düşünmeden fayda sağlayan problemleri ele alırken tercih eder.

OpenAI'nin kapsamlı eğitim verisi bu modelin geniş alan bilgisini destekliyor.

Tokonomix benchmark özeti
Bölüm 01

Hız analizi

Tüm benchmark çalıştırmalarında ölçülen gecikme. P50 (medyan) ve P95 (95. yüzdelik) normal ve yoğun yük altında yanıt hızının gerçekçi bir resmini verir.

P50 gecikme (medyan)P95 gecikme96 runs
405227941546028790208-2209-14ms
Bölüm 02

Kalite puanları

Bu modelin her soru kategorisinde sahanın geri kalanına göre nerede durduğu; aynı sorular üzerinde ikili karşılaştırmayla hesaplanır. Ham jüri puanı her sayının altındadır.

77%
Kod üretimi
jüri ortalaması 99
6%
Yaratıcı
jüri ortalaması 41
61%
Olgusal
jüri ortalaması 88
68%
Çok dilli
jüri ortalaması 99
63%
Akıl yürütme
jüri ortalaması 70

Kategori başına kazanma oranı: bu modelin o kategoriden bir soruda ortalama bir modeli ne sıklıkla yendiği. %50 ortalamadır, kalma notu değildir. Doğru cevap yüzdesi de değildir.

Bölüm 03

Fiyatlar

Bu modeli Tokonomix üzerinden kullandığınızda milyon token başına ödediğiniz tutar ve tipik bir konuşma için tahmini maliyet.

💰
API tarifeleri — o1-2024-12-17
$19.50 1M giriş token başına
$78.00 1M çıkış token başına
≈ $0.0273 tipik konuşma başına (800 token)
Giriş vs çıkış fiyatı (1M token başına)
1M giriş token başına$19.50
1M çıkış token başına$78.00
Bölüm 04

Saniye başına token

Ölçülen P50 gecikmesinden türetilen saniye başına token verimi. Yüksek daha iyidir; dalgalanmalar sağlayıcı tarafındaki yükü yansıtır.

Verim (token / s)368 / avg 283
488103

P50 gecikme × 200 çıkış token tahmininden hesaplandı — mutlak rakam bu varsayıma bağlıdır; önemli olan eğilimdir.

Bölüm 05

Güçlü & zayıf yönler

Benchmark sonuçları ve gerçek kullanım senaryolarına dair toplu topluluk geri bildirimine dayanır.

Güçlü yönler

Çok adımlı akıl yürütmeMatematik ve bilimsel analizMetin üretimi ve özetlemeÇok turlu sohbet desteğiTalimat takibinde yüksek başarıDoğal dil anlama kapasitesi

Zayıf yönler

Zincir düşünme nedeniyle yüksek gecikmeİnternet erişimi bulunmuyorGörsel işleme desteği yok
Bölüm 06

Yetenekler

toolssource: litellmvisionjson modepdf inputreasoningjson schemaparallel toolsprompt cachingmax output tokens: 100000
Bölüm 07

Sık sorulan sorular

Çok adımlı matematik, algoritma analizi ve bilimsel akıl yürütmede öne çıkıyor. Zincir düşünme ile doğruluğu artırıyor.

OpenAI güvenlik katmanları ve içerik filtreleri modeli kurumsal ortamlara uygun kılıyor.

Tokonomix benchmark özeti
Bölüm 08

Kullanılabilirlik

Kullanılabilirlik

Henüz ölçüm verisi yok

Bu model için kullanılabilirlik istatistiklerini göstermek için yeterli API çağrısı henüz kaydedilmedi. Veri, model canlı trafik almaya başlayınca görünür.

Bölüm 09

Tokonomix kıyaslama kararları

⚖️
Endorsed by 2 judges
Independent LLM judges evaluated this model on our weekly intelligence tests
cohere/command-a100/100 · 1 runs
1 correct0 partial0 wrong100% accuracy
claude-sonnet-4-587/100 · 50 runs
41 correct2 partial7 wrong82% accuracy
2026-09-13

o1-2024-12-17 achieves perfect scores with quality jump of 10.3 points

The o1-2024-12-17 model has reached a perfect 100.0 quality score, representing a significant 10.3 point improvement from the previous benchmark window's 89.7 score. This advancement is particularly notable in reasoning capabilities, which now scores 100 alongside the already excellent coding performance that has remained stable at 100 across both windows. The current benchmark window shows perfect execution across both measured categories, though it should be noted that creative and multilingual categories present in the previous window are not represented in the current test suite of 3 runs. Latency has increased slightly from 3999ms to 4132ms at the median, a modest 133ms increase that represents a 3.3% change in response time. The model continues to demonstrate the multimodal capabilities introduced in previous iterations while now showing enhanced performance in core reasoning tasks. Users should be aware that the current evaluation is based on fewer test runs compared to the previous window, and the absence of creative and multilingual scores in this window makes direct comparison across all categories incomplete.

Kalite

100.0

Gecikme p50

4,132 ms

Test çalıştırmaları

3

Quality improved 10.3 points Perfect reasoning score achieved Coding performance remains stable Latency increased by 133ms
Bölüm 10

Tam model profili

o1-2024-12-17 — illustration 1
o1-2024-12-17: OpenAI'nin ilk muhakeme modelinin Aralık 2024 üretim anlık görüntüsü

o1'in Aralık 2024 tarihli takma adı, OpenAI'nin ilk muhakeme modelinin üretime hazır davranışını sabitleyen anlık görüntüdür. İş akışlarınızı o1'in kendine özgü muhakeme tarzı etrafında kurduysanız ve zaman içinde kararlı bir davranışa ihtiyaç duyuyorsanız — özellikle düzenlemeye tabi işler veya tam tekrarlanabilirlik gerektiren denetim izleri için — sabitlemeniz gereken sürüm budur.

Bu anlık görüntü neyi temsil ediyor

Bu, daha önceki o1-preview araştırma kontrol noktasının ardından üretim kullanımı için yayımlanan haliyle o1'dir. Yetenek zarfı, hareketli o1 sayfasında anlatılanla aynıdır: dahili düşünce zinciri ile muhakeme öncelikli üretim, 200.000 belirteçlik bağlam penceresi, güçlü matematiksel ve kod sentezi performansı, milisaniyelerle değil saniyelerle ölçülen gecikme profili.

Aralık anlık görüntüsü, o1 üzerinde çalışan üretim dağıtımlarının çoğunun fiilen sabitlendiği sürümdür. Daha önceki önizleme kontrol noktasında üretim sürümü için giderilen davranışsal tuhaflıklar vardı ve o1'e karşı uygulama geliştiren ekiplerin çoğu bunu bu anlık görüntüye veya sonrasına göre yaptı. Uygulamanız üretimdeyse ve iyi çalışıyorsa, büyük ihtimalle üzerinde çalıştığı anlık görüntü budur.

Sabitleme, muhakeme modelleri için refleks modellere göre daha fazla önem taşır. Muhakeme adımı, modelin bir probleme yaklaşma biçimindeki küçük değişikliklere karşı duyarlıdır. Düşünce zinciri dağılımındaki ince bir kayma, ortalama doğruluk sabit kalsa bile modelin hangi problemleri doğru çözdüğünü ve hangilerinde hata yaptığını değiştirebilir. o1'in spesifik problem sınıfınızı çözdüğünü ampirik olarak doğruladığınız iş akışlarında, tarihli anlık görüntü bu doğrulanmış davranışı koruyan sözleşmedir.

Bu anlık görüntüye sabitlemenin doğru olduğu durumlar

Denetim izlerinin uzun zaman dilimlerinde modelin çıktılarının tam tekrarlanabilirliğini gerektirdiği düzenlemeye tabi iş akışları. Sözleşme analizi yapan hukuk teknolojisi uygulamalarında, kesin muhakeme yolunun aşağı akış incelemesi için önem taşıdığı durumlar. Model destekli muhakemenin tekrarlanabilirliğinin metodolojik bir gereklilik olduğu bilimsel uygulamalar. Düzenleyicilerin sonunda belirli bir önerinin neden yapıldığını sorabileceği finansal hizmet uygulamaları.

Keşif amaçlı çalışmalar, prototip yapımı ve OpenAI'nin daha yeni muhakeme modellerinde yayınladığı sürekli iyileştirmeleri takip etmek istediğiniz herhangi bir iş akışı için bu anlık görüntü doğru başlangıç noktası değildir. Yeni çalışmalar, o1 nesline göre anlamlı yetenek iyileştirmelerini temsil eden o3 veya o4-mini modellerini kullanmalıdır.

Bu anlık görüntüden daha yeni bir muhakeme modeline geçiş riski önemsiz değildir. o1 ile o3 arasındaki muhakeme davranışı, o1'e göre kalibre edilmiş istem örüntülerinin sorunsuzca aktarılmayabileceği kadar farklıdır. Doğrudan bir yükseltme değil, yeniden doğrulama çalışması planlayın.

Yetersiz kaldığı yerler

Gerçek zamanlı konuşma uygulamaları. o1'in gecikme profili, saniyenin altında yanıt gerektiren sohbet arayüzleriyle uyumsuzdur. Bu iş yükleri için refleks modelleri kullanın ve o1'i zor dönüm noktaları için saklayın.

Basit özetleme ve çıkarma görevleri. Muhakeme adımı, gerektirmeyen görevlerde boşa harcanır ve bu boşa harcanan hesaplama için ödeme yaparsınız. Refleks modeller bu görevleri daha hızlı ve daha ucuza halleder.

Akışın önemli olduğu yaratıcı yazım. o1 dikkatli, doğru bir düzyazı üretir. Ses, ritim veya üslup ister istemez söz konusu olduğunda doğru araç değildir. Sohbet katmanı modelleri genellikle daha iyi yaratıcı çıktılar verir.

Çok sıkı döngülü, yoğun araç kullanan ajan iş akışları. Muhakeme gecikmesi turlar boyunca birikir. Çağrılar arasında muhakeme yaparak araçları hızlıca çağırması gereken ajanlarda, kümülatif bekleme süresi döngüyü ürün deneyimini etkileyecek biçimde yavaşlatır.

Pratik notlar ve alternatifler

Aynı nesilde daha yüksek çaba gerektiren muhakeme için o1-pro ve tarihli anlık görüntüsü o1-pro-2025-03-19, maksimum doğruluğun ek maliyeti haklı kıldığı problemlerde istem başına daha fazla muhakeme hesaplaması harcar. Pro varyantı, tek seferde doğru cevap alma olasılığını en üst düzeye çıkarmak istediğiniz en zor muhakeme problemleri için doğru tercihtir.

Yeni nesil muhakeme için o3 ve tarihli anlık görüntüsü o3-2025-04-16, ardıl yeteneği temsil eder. o4-mini, daha önce o1 kullanan birçok iş yükü için maliyet açısından verimli orta katman muhakeme modelidir.

Tarama, sentez ve dış kaynaklar arasında muhakeme gerektiren araştırma iş akışları için o4-mini-deep-research, araştırma moduna ayrılmış varyanttır. Bu, o1'den farklı bir operasyonel biçimdir ve o1'in hiçbir zaman tam olarak doğru aracı olmadığı bir iş yükünü hedefler.

AB veri ikametgâhı, bu anlık görüntüde veya ilgili OpenAI muhakeme uç noktalarının herhangi birinde varsayılan olarak karşılanmaz. Veri işleme sözleşmeleri olan bölgesel ağ geçitleri, düzenlemeye tabi Avrupa dağıtımları için pratik geçici çözüm olmaya devam ediyor. Tarihli takma adın kullanımdan kaldırılma zaman çizelgesi şu anda duyurulmamıştır; ancak muhakeme modeli anlık görüntüleri, geçişin daha yüksek yeniden doğrulama maliyeti göz önüne alındığında, refleks modeli anlık görüntülerinden genellikle daha uzun destek pencerelerine sahip olmuştur.

Son teknik inceleme: 2026-05-22 — Tokonomix.ai

o1-2024-12-17 — illustration 2
Son otomatik test
14 Eyl 2026 · 20:04 UTC · Hız testi
P50 gecikme
543 ms
P95 gecikme
911 ms
Hatalar
0 / 6 çalıştırma
Son inceleyen Tokonomix Ekibi·26 Mayıs 2026