İçeriğe geç
Seviye A — Öncü
Çalıştığı yer:CNYapıldığı yer:China
Z.ai (GLM / Zhipu)

GLM-5

Seviye A — Öncü · 205K token

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GLM-5, Zhipu’nun z.ai üzerindeki GLM-5 neslinin taban modelidir — GLM-5.2 amiral gemisinin altında fiyatlandırılan, neslin iş atıdır. Araç ve JSON desteğine sahip, OpenAI uyumlu bir akıl yürütme sohbet modelidir.

Bölüm 01

Hız analizi

Tüm benchmark çalıştırmalarında ölçülen gecikme. P50 (medyan) ve P95 (95. yüzdelik) normal ve yoğun yük altında yanıt hızının gerçekçi bir resmini verir.

P50 gecikme (medyan)P95 gecikme104 runs
91542657614109641431308-1209-07ms
Bölüm 02

Kalite puanları

Bu modelin her soru kategorisinde sahanın geri kalanına göre nerede durduğu; aynı sorular üzerinde ikili karşılaştırmayla hesaplanır. Ham jüri puanı her sayının altındadır.

57%
Kod üretimi
jüri ortalaması 93
89%
Yaratıcı
jüri ortalaması 98
64%
Olgusal
jüri ortalaması 91
62%
Akıl yürütme
jüri ortalaması 98

Kategori başına kazanma oranı: bu modelin o kategoriden bir soruda ortalama bir modeli ne sıklıkla yendiği. %50 ortalamadır, kalma notu değildir. Doğru cevap yüzdesi de değildir.

Bölüm 03

Fiyat geçmişi

Milyon token başına doğrudan sağlayıcı tarifeleri, artı tipik bir konuşma maliyet tahmini.

💰
API tarifeleri — GLM-5
$1.00 1M giriş token başına
$3.20 1M çıkış token başına
≈ $0.0012 tipik konuşma başına (800 token)
Giriş vs çıkış fiyatı (1M token başına)
1M giriş token başına$1.00
1M çıkış token başına$3.20

Pricing over time

Input & output per 1M tokens · step-line = price changes

$1.00

input / 1M

— stable

$3.20

output / 1M

— stable

2026-07-122026-08-162026-09-06
Input
Output
Price change
⟳ synced weekly
Bölüm 04

Saniye başına token

Ölçülen P50 gecikmesinden türetilen saniye başına token verimi. Yüksek daha iyidir; dalgalanmalar sağlayıcı tarafındaki yükü yansıtır.

Verim (token / s)74 / avg 92
21741

P50 gecikme × 200 çıkış token tahmininden hesaplandı — mutlak rakam bu varsayıma bağlıdır; önemli olan eğilimdir.

Bölüm 05

Yetenekler

jsonnotes: GLM emits a non-standard reasoning_content field beside content; read content for the answer.toolsreasoning
Bölüm 06

Kullanılabilirlik

Kullanılabilirlik

Bu modelin çağrıldığında ne sıklıkla yanıt verdiği — son 30 gün içindeki gerçek API istekleri ve canlı testler üzerinden ölçülmüştür. Bu kaliteden bağımsızdır: bu sayılar yalnızca modelin yanıt verip vermediğini gösterir, yanıtın ne kadar iyi olduğunu değil.

Son 7 gün

Son 30 gün

33.3%

n=6

Medyan yanıt süresi

91,708ms

n=2

Baz alınan 385 ölçüm son 30 gün içinde.

Teknik detaylar

Yalnızca gerçek API çağrıları ve canlı test istekleri sayılır — dahili yoklamalar ve kıyaslama çalıştırmaları hariçtir.

Özel API anahtarıyla (BYOK) yapılan çağrılar hariçtir: bu hatalar anahtara özgüdür, model kesintisinin işareti değildir.

Başarısız çağrılar kalite puanlarına DAHİL EDİLMEZ — kalite yalnızca başarılı yanıtlar üzerinden ölçülür. Kullanılabilirlik ve kalite bağımsız sinyallerdir.

Kaydedilmiş süreye sahip başarılı çağrılarda medyan yanıt süresi (p50). Aykırı değerler medyanı ortalamadan daha az etkiler.

Toplam çağrı (30d)

6

OK yanıtlar (30d)

2

Toplam çağrı (7d)

0

OK yanıtlar (7d)

0

Bölüm 07

Tokonomix kıyaslama kararları

⚖️
Endorsed by 1 judge
Independent LLM judges evaluated this model on our weekly intelligence tests
claude-sonnet-4-594/100 · 28 runs
26 correct0 partial2 wrong93% accuracy
2026-09-06

GLM-5 shows slight quality decline with increased latency

GLM-5 has returned with limited benchmark data, showing a modest decline from previous performance levels. The overall quality score dropped from 97.0 to 96.0, while latency increased by 18% from 7051ms to 8287ms at the median. The current testing window includes only two test runs, compared to three in the previous period, which limits the statistical confidence of these results. Coding performance specifically declined from a perfect 100 to 96, though this remains a strong absolute score. Notably absent from the current window are factual and reasoning category results, which previously showed excellent performance at 100 and 91 respectively. This makes it difficult to assess whether the model has changed in these areas or if testing coverage has simply narrowed. The reduced test run count and missing category data suggest either limited evaluation activity or a more focused testing approach. Users should note that while the current scores remain competitive, the directional trend shows degradation across both performance and speed metrics. The model continues to demonstrate strong coding capabilities, but the incomplete picture from this benchmark window makes it challenging to draw definitive conclusions about overall capability changes.

Kalite

96.0

Gecikme p50

8,287 ms

Test çalıştırmaları

2

Quality score decreased to 96 Latency increased 18% Coding score dropped from 100 Limited category coverage
Bölüm 08

Tam model profili

GLM-5: Zhipu’nun en yeni neslinin tabanı

GLM-5, Zhipu’nun z.ai üzerindeki GLM-5 neslinin taban modelidir — GLM-5.2 amiral gemisinin altında fiyatlandırılan, neslin iş atıdır. Araç ve JSON desteğine sahip, OpenAI uyumlu bir akıl yürütme sohbet modelidir.

z.ai, GLM-5’i 1M giriş tokeni başına 1,00 $ ve 1M çıkış tokeni başına 3,20 $ olarak yayımlar — aynı nesil içinde kalırken GLM-5.2 amiral gemisinden daha ucuzdur.

Onu geçici bir değer olarak geniş (~200K tokenlik) bir bağlam penceresiyle kaydettik; GLM-5 nesli belgeleri sınırlı olduğundan, güvenmeden önce kesin pencereyi z.ai üzerinden doğrulayın.

Mimari ve eğitim sinyalleri

GLM-5, Zhipu AI’nin GLM-5 neslinin tabanıdır. Kamuya açık teknik ayrıntılar Temmuz 2026 itibarıyla hâlâ sınırlıdır; onu, OpenAI uyumlu bir uç nokta üzerinden araç çağırma ve yapılandırılmış JSON desteğine sahip, akıl yürütme odaklı büyük bir sohbet modeli olarak değerlendiriyoruz. GLM serisinin geri kalanı gibi, content alanının yanında standart olmayan bir reasoning_content alanı döndürür; entegrasyonlar nihai yanıt için content alanını okumalı ve reasoning_content alanını isteğe bağlı bir iz olarak değerlendirmelidir.

Öne çıktığı yerler

  • En yeni GLM neslinde dengeli bir kalite-fiyat noktası.
  • Uzun bağlamlı akıl yürütme ve analiz.
  • Bir uzlaşı panelinde farklı aileler arası çeşitlilik.

Yetersiz kaldığı yerler

  • Yine de GLM-4.x serisinden ve ücretsiz flash katmanlarından daha pahalı.
  • Sınırlı yeniden üretilebilir kıyaslama verisi; iş yükünüzde doğrulayın.
  • AB dışı barındırma.

Gerçek dünya kullanım örnekleri

  • Amiral gemisi fiyatı olmadan mevcut nesil GLM kalitesini istediğiniz genel akıl yürütme.
  • Belge analizi ve özetleme.
  • Agentik araç kullanım hatları.

Tokonomix kıyaslama anlık görüntüsü

GLM-5 Tokonomix'e yeni kaydedildi ve henüz etkinleştirilmedi, bu nedenle onu henüz haftalık zekâ testimizden veya hız kıyaslamamızdan geçirmedik. Bildirilecek herhangi bir Tokonomix puanı yok — ve uydurmayacağız.

Yayına girdiğinde, diğer her model gibi aynı haftalık düzeneğe girer: aynı istemler, bağımsız ve farklı aileden bir jüri ve yeniden üretilebilir gecikme ve maliyet ölçümleri. O zamana kadar bu sayfadaki fiyat ve yetenek notlarını, Tokonomix'in ölçtüğü sonuçlar olarak değil, sağlayıcının yayımladığı başlangıç noktası olarak değerlendirin.

AB gizliliği ve veri ikametgâhı

GLM-5, merkezi Çin'de bulunan bir laboratuvar olan Zhipu AI (z.ai) tarafından geliştirilmiştir ve AB dışı altyapıdan sunulur. Bunu açıkça belirtmek gerekir: bu modele bir istem göndermek AB veri ikametgâhı veya GDPR egemenliği tercihi değildir ve Tokonomix bunu asla öyle etiketlemez.

Kullanım durumunuz verilerin AB içinde kalmasını gerektiriyorsa, bir GLM modeli yerine AB'de barındırılan bir model seçin (örneğin OVH veya Azure-EU rotalarımız). Tokonomix, z.ai'yi tasarım gereği her AB'ye özel/egemen yönlendirme kümesinin dışında tutar. GLM'yi, yeteneğin veya fiyatın öncelikli olduğu ve o iş yükü için sınır ötesi işlemenin kabul edilebilir olduğu yerlerde kullanın.

Sonuç ve alternatifler

GLM-5, GLM-5 nesli içinde makul bir varsayılandır: GLM-5.2’den daha düşük bir fiyata en yeni neslin kalitesinin çoğu. Mutlak zirveye ihtiyacınız varsa GLM-5.2’ye gidin; bütçe baskınsa GLM-4.6/4.5’e veya ücretsiz flash modellere inin.

Son otomatik test
7 Eyl 2026 · 14:02 UTC · Hız testi
P50 gecikme
2714 ms
P95 gecikme
3145 ms
Hatalar
0 / 6 çalıştırma
Son inceleyen Tokonomix Ekibi·8 Temmuz 2026