İçeriğe geç
Seviye B — Üretim
Çalıştığı yer:CNYapıldığı yer:China
Z.ai (GLM / Zhipu)

GLM-4.5 Air

Seviye B — Üretim · 131K token

Tokonomix Editöryel Ekibi·İnceleyen Mes Kalkan··

GLM-4.5 Air, GLM-4.5’in hafif kardeşidir — hız ve hacim için ayarlanmış, daha küçük ve daha ucuz bir model. Token başına maliyet ve verimin zirve kaliteden daha önemli olduğu durumlarda başvurulan GLM’dir.

Bölüm 01

Hız analizi

Tüm benchmark çalıştırmalarında ölçülen gecikme. P50 (medyan) ve P95 (95. yüzdelik) normal ve yoğun yük altında yanıt hızının gerçekçi bir resmini verir.

P50 gecikme (medyan)P95 gecikme57 runs
369815215935237173150007-0807-22ms
Bölüm 02

Kalite puanları

Çeşitli görev kategorilerinde yargıç modelin puanlarından elde edilen değerlendirme sonuçları. Puanlar tutarlılık, doğruluk ve talimat takibini yansıtır.

100
Kod üretimi
45
Yaratıcı
Bölüm 03

Fiyat geçmişi

Milyon token başına doğrudan sağlayıcı tarifeleri, artı tipik bir konuşma maliyet tahmini.

💰
API tarifeleri — GLM-4.5 Air
$0.2000 1M giriş token başına
$1.10 1M çıkış token başına
≈ $0.0003 tipik konuşma başına (800 token)
Giriş vs çıkış fiyatı (1M token başına)
1M giriş token başına$0.2000
1M çıkış token başına$1.10

Pricing over time

Input & output per 1M tokens · step-line = price changes

$0.2000

input / 1M

— stable

$1.10

output / 1M

— stable

2026-07-122026-07-192026-07-19
Input
Output
Price change
⟳ synced weekly
Bölüm 04

Saniye başına token

Ölçülen P50 gecikmesinden türetilen saniye başına token verimi. Yüksek daha iyidir; dalgalanmalar sağlayıcı tarafındaki yükü yansıtır.

Verim (token / s)46 / avg 47
5366

P50 gecikme × 200 çıkış token tahmininden hesaplandı — mutlak rakam bu varsayıma bağlıdır; önemli olan eğilimdir.

Bölüm 05

Yetenekler

jsonnotes: GLM emits a non-standard reasoning_content field beside content; read content for the answer.toolsreasoning
Bölüm 06

Kullanılabilirlik

Kullanılabilirlik

Bu modelin çağrıldığında ne sıklıkla yanıt verdiği — son 30 gün içindeki gerçek API istekleri ve canlı testler üzerinden ölçülmüştür. Bu kaliteden bağımsızdır: bu sayılar yalnızca modelin yanıt verip vermediğini gösterir, yanıtın ne kadar iyi olduğunu değil.

Son 7 gün

Son 30 gün

100.0%

n=1

Medyan yanıt süresi

5,107ms

n=1

Baz alınan 178 ölçüm son 30 gün içinde.

Teknik detaylar

Yalnızca gerçek API çağrıları ve canlı test istekleri sayılır — dahili yoklamalar ve kıyaslama çalıştırmaları hariçtir.

Özel API anahtarıyla (BYOK) yapılan çağrılar hariçtir: bu hatalar anahtara özgüdür, model kesintisinin işareti değildir.

Başarısız çağrılar kalite puanlarına DAHİL EDİLMEZ — kalite yalnızca başarılı yanıtlar üzerinden ölçülür. Kullanılabilirlik ve kalite bağımsız sinyallerdir.

Kaydedilmiş süreye sahip başarılı çağrılarda medyan yanıt süresi (p50). Aykırı değerler medyanı ortalamadan daha az etkiler.

Toplam çağrı (30d)

1

OK yanıtlar (30d)

1

Toplam çağrı (7d)

0

OK yanıtlar (7d)

0

Bölüm 07

Tokonomix kıyaslama kararları

⚖️
Endorsed by 1 judge
Independent LLM judges evaluated this model on our weekly intelligence tests
claude-sonnet-4-574/100 · 6 runs
4 correct0 partial2 wrong67% accuracy
2026-07-19

GLM-4.5 Air adds tool support, reasoning; core performance unchanged

GLM-4.5 Air has expanded its capabilities with the addition of JSON mode, tool calling, and reasoning features, marking a significant enhancement to its functional toolkit. However, performance metrics across core tasks remain largely consistent with the previous benchmark window. The model continues to demonstrate strong competency in coding tasks while showing weaknesses in creative writing domains. The addition of tool support positions GLM-4.5 Air as more versatile for enterprise and application development scenarios, enabling function calling and structured output generation that were previously unavailable. The reasoning capability suggests potential for more complex problem-solving workflows, though benchmark scores indicate the fundamental quality of outputs has not shifted dramatically. Users evaluating this model should note that while the feature set has grown substantially, making it suitable for a broader range of use cases, the underlying performance characteristics remain steady. Creative writing tasks still represent a relative weakness compared to technical applications. The expanded capabilities make GLM-4.5 Air a more complete offering for developers seeking structured interactions and tool integration, while those prioritizing creative or narrative generation may still find limitations.

Quality

Latency p50

Test runs

0

JSON and tool support added New reasoning capability introduced Creative writing remains weak Core performance metrics unchanged
Bölüm 08

Tam model profili

GLM-4.5 Air: hafif, düşük maliyetli GLM

GLM-4.5 Air, GLM-4.5’in hafif kardeşidir — hız ve hacim için ayarlanmış, daha küçük ve daha ucuz bir model. Token başına maliyet ve verimin zirve kaliteden daha önemli olduğu durumlarda başvurulan GLM’dir.

z.ai, GLM-4.5 Air’i 1M giriş tokeni başına 0,20 $ ve 1M çıkış tokeni başına 1,10 $ olarak yayımlar — standart GLM-4.5’in oldukça altında, en ucuz ücretli GLM katmanı.

128K tokenlik bir bağlam penceresi sunar.

Mimari ve eğitim sinyalleri

GLM-4.5 Air, Zhipu AI’nin GLM-4.5’inin daha küçük, verimlilik odaklı varyantıdır. Verim ve maliyeti hedefleyen daha hafif bir pakette araç çağırma ve JSON desteğini, OpenAI uyumlu bir uç nokta üzerinden korur. GLM serisinin geri kalanı gibi, content alanının yanında standart olmayan bir reasoning_content alanı döndürür; entegrasyonlar nihai yanıt için content alanını okumalı ve reasoning_content alanını isteğe bağlı bir iz olarak değerlendirmelidir.

Öne çıktığı yerler

  • Yüksek hacimli, maliyete duyarlı iş yükleri — sınıflandırma, çıkarım, toplu yazım.
  • Tam GLM-4.5’ten daha düşük gecikme.
  • En düşük ücretli GLM fiyat noktası.

Yetersiz kaldığı yerler

  • Tam boyutlu modellerden daha düşük bir tavan — en zorlu akıl yürütme için değil.
  • Henüz Tokonomix kıyaslama verisi yok; kendi görevlerinizde doğrulayın.
  • AB dışı barındırma.

Gerçek dünya kullanım örnekleri

  • Maliyetin baskın olduğu toplu veri işleme.
  • Hızlı, ucuz yanıtlar gerektiren etkileşimli özellikler.
  • Daha güçlü bir model iyileştirmeden önceki ilk taslak.

Tokonomix kıyaslama anlık görüntüsü

GLM-4.5 Air Tokonomix'e yeni kaydedildi ve henüz etkinleştirilmedi, bu nedenle onu henüz haftalık zekâ testimizden veya hız kıyaslamamızdan geçirmedik. Bildirilecek herhangi bir Tokonomix puanı yok — ve uydurmayacağız.

Yayına girdiğinde, diğer her model gibi aynı haftalık düzeneğe girer: aynı istemler, bağımsız ve farklı aileden bir jüri ve yeniden üretilebilir gecikme ve maliyet ölçümleri. O zamana kadar bu sayfadaki fiyat ve yetenek notlarını, Tokonomix'in ölçtüğü sonuçlar olarak değil, sağlayıcının yayımladığı başlangıç noktası olarak değerlendirin.

AB gizliliği ve veri ikametgâhı

GLM-4.5 Air, merkezi Çin'de bulunan bir laboratuvar olan Zhipu AI (z.ai) tarafından geliştirilmiştir ve AB dışı altyapıdan sunulur. Bunu açıkça belirtmek gerekir: bu modele bir istem göndermek AB veri ikametgâhı veya GDPR egemenliği tercihi değildir ve Tokonomix bunu asla öyle etiketlemez.

Kullanım durumunuz verilerin AB içinde kalmasını gerektiriyorsa, bir GLM modeli yerine AB'de barındırılan bir model seçin (örneğin OVH veya Azure-EU rotalarımız). Tokonomix, z.ai'yi tasarım gereği her AB'ye özel/egemen yönlendirme kümesinin dışında tutar. GLM'yi, yeteneğin veya fiyatın öncelikli olduğu ve o iş yükü için sınır ötesi işlemenin kabul edilebilir olduğu yerlerde kullanın.

Sonuç ve alternatifler

GLM-4.5 Air, GLM ekonomi katmanıdır: ucuz ve hızlı, makul ölçüde daha düşük bir tavanla. Maliyet daha da önemliyse GLM-4.7/4.5 Flash katmanları ücretsizdir; kalite daha önemliyse tam GLM-4.5 veya üzerine geçin.

Son otomatik test
22 Tem 2026 · 08:00 UTC · Hız testi
P50 gecikme
4376 ms
P95 gecikme
15384 ms
Hatalar
0 / 6 çalıştırma
Son inceleyen Tokonomix Ekibi·8 Temmuz 2026