İçeriğe geç
Seviye B — Üretim
Çalıştığı yer:CNYapıldığı yer:China
Z.ai (GLM / Zhipu)

GLM-5 Turbo

Seviye B — Üretim · 205K token

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GLM-5 Turbo, z.ai üzerindeki GLM-5 neslinin hız odaklı varyantıdır. “Turbo” GLM katmanları tarihsel olarak biraz zirve kaliteyi daha düşük gecikme ve maliyet karşılığında feda ederek, bir nesil içindeki verim seçeneği haline gelir.

Bölüm 01

Hız analizi

Tüm benchmark çalıştırmalarında ölçülen gecikme. P50 (medyan) ve P95 (95. yüzdelik) normal ve yoğun yük altında yanıt hızının gerçekçi bir resmini verir.

P50 gecikme (medyan)P95 gecikme57 runs
1293884516397239483150007-0807-22ms
Bölüm 02

Kalite puanları

Çeşitli görev kategorilerinde yargıç modelin puanlarından elde edilen değerlendirme sonuçları. Puanlar tutarlılık, doğruluk ve talimat takibini yansıtır.

90
Kod üretimi
45
Yaratıcı
Bölüm 03

Fiyat geçmişi

Milyon token başına doğrudan sağlayıcı tarifeleri, artı tipik bir konuşma maliyet tahmini.

💰
API tarifeleri — GLM-5 Turbo
$1.20 1M giriş token başına
$4.00 1M çıkış token başına
≈ $0.0015 tipik konuşma başına (800 token)
Giriş vs çıkış fiyatı (1M token başına)
1M giriş token başına$1.20
1M çıkış token başına$4.00

Pricing over time

Input & output per 1M tokens · step-line = price changes

$1.20

input / 1M

— stable

$4.00

output / 1M

— stable

2026-07-122026-07-192026-07-19
Input
Output
Price change
⟳ synced weekly
Bölüm 04

Saniye başına token

Ölçülen P50 gecikmesinden türetilen saniye başına token verimi. Yüksek daha iyidir; dalgalanmalar sağlayıcı tarafındaki yükü yansıtır.

Verim (token / s)49 / avg 70
1545

P50 gecikme × 200 çıkış token tahmininden hesaplandı — mutlak rakam bu varsayıma bağlıdır; önemli olan eğilimdir.

Bölüm 05

Yetenekler

jsonnotes: GLM emits a non-standard reasoning_content field beside content; read content for the answer.toolsreasoningprice note: No published price on 2026-07-06
Bölüm 06

Kullanılabilirlik

Kullanılabilirlik

Bu modelin çağrıldığında ne sıklıkla yanıt verdiği — son 30 gün içindeki gerçek API istekleri ve canlı testler üzerinden ölçülmüştür. Bu kaliteden bağımsızdır: bu sayılar yalnızca modelin yanıt verip vermediğini gösterir, yanıtın ne kadar iyi olduğunu değil.

Son 7 gün

Son 30 gün

100.0%

n=1

Medyan yanıt süresi

6,573ms

n=1

Baz alınan 178 ölçüm son 30 gün içinde.

Teknik detaylar

Yalnızca gerçek API çağrıları ve canlı test istekleri sayılır — dahili yoklamalar ve kıyaslama çalıştırmaları hariçtir.

Özel API anahtarıyla (BYOK) yapılan çağrılar hariçtir: bu hatalar anahtara özgüdür, model kesintisinin işareti değildir.

Başarısız çağrılar kalite puanlarına DAHİL EDİLMEZ — kalite yalnızca başarılı yanıtlar üzerinden ölçülür. Kullanılabilirlik ve kalite bağımsız sinyallerdir.

Kaydedilmiş süreye sahip başarılı çağrılarda medyan yanıt süresi (p50). Aykırı değerler medyanı ortalamadan daha az etkiler.

Toplam çağrı (30d)

1

OK yanıtlar (30d)

1

Toplam çağrı (7d)

0

OK yanıtlar (7d)

0

Bölüm 07

Tokonomix kıyaslama kararları

⚖️
Endorsed by 1 judge
Independent LLM judges evaluated this model on our weekly intelligence tests
claude-sonnet-4-557/100 · 6 runs
2 correct1 partial3 wrong33% accuracy
2026-07-19

GLM-5 Turbo adds tool support while maintaining baseline performance

GLM-5 Turbo has expanded its capabilities with the addition of JSON mode, tool calling, and reasoning features in this benchmark window. Performance metrics show general stability across most evaluated tasks, with the model maintaining its previous positioning in the competitive landscape. The model continues to demonstrate solid coding abilities and mathematical reasoning comparable to its initial debut. Its performance on standard benchmarks remains consistent, showing neither significant gains nor regressions in core competencies. The newly added tool calling and structured output capabilities extend the model's practical utility for application developers, though benchmark data on these specific features is still limited. GLM-5 Turbo appears positioned as a capable mid-tier option for developers seeking a balance of reasoning, coding, and now function-calling abilities. The stability in performance metrics suggests reliable iteration from Zhipu, though the model has not made dramatic leaps in benchmark standings. Users evaluating this model should consider it for applications requiring multi-modal capability support rather than expecting cutting-edge performance in any single domain. The addition of tool support makes it more viable for agent-based workflows and structured data extraction tasks.

Quality

Latency p50

Test runs

0

Added tool calling support JSON mode now available Performance remains stable
Bölüm 08

Tam model profili

GLM-5 Turbo: hıza ayarlı GLM-5 varyantı

GLM-5 Turbo, z.ai üzerindeki GLM-5 neslinin hız odaklı varyantıdır. “Turbo” GLM katmanları tarihsel olarak biraz zirve kaliteyi daha düşük gecikme ve maliyet karşılığında feda ederek, bir nesil içindeki verim seçeneği haline gelir.

z.ai, kayıt sırasında (Temmuz 2026) GLM-5 Turbo için kamuya açık bir fiyat yayımlamamıştı, bu yüzden herhangi bir faturalama rakamı saklamıyoruz. Turbo katmanları genellikle taban modelden daha ucuzdur, ancak etkinleştirmeden önce gerçek oranı z.ai üzerinden doğrulayın.

Onu geçici bir değer olarak geniş (~200K tokenlik) bir bağlam penceresiyle kaydettik; GLM-5 nesli belgeleri sınırlı olduğundan, güvenmeden önce kesin pencereyi z.ai üzerinden doğrulayın.

Mimari ve eğitim sinyalleri

GLM-5 Turbo, Zhipu AI’nin GLM-5 neslinin gecikme/verime yönelik bir üyesidir. Ayrıntılı kamuya açık belgeler Temmuz 2026 itibarıyla sınırlıdır. Onu, OpenAI uyumlu bir uç nokta üzerinden araç ve JSON desteğine sahip, akıl yürütme yapabilen hızlı bir sohbet modeli olarak değerlendiriyoruz. GLM serisinin geri kalanı gibi, content alanının yanında standart olmayan bir reasoning_content alanı döndürür; entegrasyonlar nihai yanıt için content alanını okumalı ve reasoning_content alanını isteğe bağlı bir iz olarak değerlendirmelidir.

Öne çıktığı yerler

  • GLM-5 nesli içinde daha yüksek verimli veya gecikmeye duyarlı görevler.
  • Hızın ve maliyetin son birkaç kalite puanından daha önemli olduğu toplu işleme.
  • Araç çağırma ve JSON çıktısı.

Yetersiz kaldığı yerler

  • Kayıt sırasında yayımlanmış fiyat yok — etkinleştirmeden önce doğrulayın.
  • GLM-5 tabanına kıyasla muhtemelen küçük bir kalite feragati; kalite kritikse doğrulayın.
  • AB dışı barındırma.

Gerçek dünya kullanım örnekleri

  • Gecikmenin önemli olduğu yüksek hacimli sınıflandırma, çıkarım veya taslak hazırlama.
  • Daha hızlı yanıtlara ihtiyaç duyan etkileşimli deneyimler.
  • Çok sayıda kısa çağrı içeren agentik döngüler.

Tokonomix kıyaslama anlık görüntüsü

GLM-5 Turbo Tokonomix'e yeni kaydedildi ve henüz etkinleştirilmedi, bu nedenle onu henüz haftalık zekâ testimizden veya hız kıyaslamamızdan geçirmedik. Bildirilecek herhangi bir Tokonomix puanı yok — ve uydurmayacağız.

Yayına girdiğinde, diğer her model gibi aynı haftalık düzeneğe girer: aynı istemler, bağımsız ve farklı aileden bir jüri ve yeniden üretilebilir gecikme ve maliyet ölçümleri. O zamana kadar bu sayfadaki fiyat ve yetenek notlarını, Tokonomix'in ölçtüğü sonuçlar olarak değil, sağlayıcının yayımladığı başlangıç noktası olarak değerlendirin.

AB gizliliği ve veri ikametgâhı

GLM-5 Turbo, merkezi Çin'de bulunan bir laboratuvar olan Zhipu AI (z.ai) tarafından geliştirilmiştir ve AB dışı altyapıdan sunulur. Bunu açıkça belirtmek gerekir: bu modele bir istem göndermek AB veri ikametgâhı veya GDPR egemenliği tercihi değildir ve Tokonomix bunu asla öyle etiketlemez.

Kullanım durumunuz verilerin AB içinde kalmasını gerektiriyorsa, bir GLM modeli yerine AB'de barındırılan bir model seçin (örneğin OVH veya Azure-EU rotalarımız). Tokonomix, z.ai'yi tasarım gereği her AB'ye özel/egemen yönlendirme kümesinin dışında tutar. GLM'yi, yeteneğin veya fiyatın öncelikli olduğu ve o iş yükü için sınır ötesi işlemenin kabul edilebilir olduğu yerlerde kullanın.

Sonuç ve alternatifler

GLM-5 Turbo, GLM-5 neslinin verim seçeneğidir. Hız ve maliyet, kalitenin son artışından daha önemli olduğunda seçin — ancak önce yayımlanmamış fiyatını doğrulayın. Maksimum kalite için GLM-5 veya GLM-5.2’yi kullanın; ücretsiz verim için GLM Flash katmanlarını.

Son otomatik test
22 Tem 2026 · 08:03 UTC · Hız testi
P50 gecikme
4056 ms
P95 gecikme
4150 ms
Hatalar
0 / 6 çalıştırma
Son inceleyen Tokonomix Ekibi·8 Temmuz 2026