Naar inhoud
Tier B — Productie
Draait in:CNGemaakt in:China
Z.ai (GLM / Zhipu)

GLM-4.5 Air

Tier B — Productie · 131K tokens

Tokonomix-redactie·Gecontroleerd door Mes Kalkan··

GLM-4.5 Air is het lichtgewicht broertje van GLM-4.5 — een kleiner, goedkoper model afgestemd op snelheid en volume. Het is de GLM waar je naar grijpt wanneer kosten-per-token en doorvoer belangrijker zijn dan piekkwaliteit.

Sectie 01

Snelheidsanalyse

Latency gemeten over alle benchmark-runs. P50 (mediaan) en P95 (95e percentiel) geven een realistisch beeld van de responssnelheid onder normale en piekbelasting.

P50 latency (mediaan)P95 latency57 runs
369815215935237173150007-0807-22ms
Sectie 02

Kwaliteitsscores

Evaluatieresultaten van judge-model beoordelingen over diverse taakcategorieën. Scores weerspiegelen coherentie, accuratesse en instructieopvolging.

100
Code generatie
45
Creatief
Sectie 03

Prijsgeschiedenis

Directe provider-tarieven per miljoen tokens, plus een typische gespreks-kostschatting.

💰
API-tarieven — GLM-4.5 Air
$0.2000 per 1M input-tokens
$1.10 per 1M output-tokens
≈ $0.0003 per typisch gesprek (800 tokens)
Input vs output prijs (per 1M tokens)
per 1M input-tokens$0.2000
per 1M output-tokens$1.10

Pricing over time

Input & output per 1M tokens · step-line = price changes

$0.2000

input / 1M

— stable

$1.10

output / 1M

— stable

2026-07-122026-07-192026-07-19
Input
Output
Price change
⟳ synced weekly
Sectie 04

Tokens per seconde

Doorvoersnelheid in tokens per seconde, afgeleid uit gemeten P50-latency. Hogere waarden zijn beter; fluctuaties weerspiegelen serverbelasting bij de provider.

Doorvoer (tokens / s)46 / avg 47
5366

Geschat uit P50-latency × 200 output-tokens — het absolute getal hangt af van deze aanname; de trend is wat telt.

Sectie 05

Mogelijkheden

jsonnotes: GLM emits a non-standard reasoning_content field beside content; read content for the answer.toolsreasoning
Sectie 06

Beschikbaarheid

Beschikbaarheid

Hoe vaak dit model antwoordt als we het aanroepen — gemeten over echte API-aanvragen en live-tests in de afgelopen 30 dagen. Dit staat los van kwaliteit: deze cijfers laten alleen zien of het model reageert, niet hoe goed het antwoord is.

Afgelopen 7 dagen

Afgelopen 30 dagen

100.0%

n=1

Mediane responstijd

5,107ms

n=1

Gebaseerd op 178 metingen in de afgelopen 30 dagen.

Technische details

Alleen echte API-aanroepen en live-testverzoeken tellen mee — interne probes en benchmarkruns zijn uitgesloten.

Aanroepen met een eigen API-sleutel (BYOK) zijn uitgesloten: die fouten zijn sleutelspecifiek en geen teken van modelneergang.

Mislukte aanroepen worden NIET meegeteld in kwaliteitsscores — kwaliteit wordt gemeten op geslaagde responses. Beschikbaarheid en kwaliteit zijn onafhankelijke signalen.

Mediane responstijd (p50) over geslaagde aanroepen met een vastgelegde duur. Uitschieters trekken de mediaan minder dan het gemiddelde.

Totaal aanroepen (30d)

1

OK-reacties (30d)

1

Totaal aanroepen (7d)

0

OK-reacties (7d)

0

Sectie 07

Tokonomix benchmark-oordelen

⚖️
Endorsed by 1 judge
Independent LLM judges evaluated this model on our weekly intelligence tests
claude-sonnet-4-574/100 · 6 runs
4 correct0 partial2 wrong67% accuracy
2026-07-19

GLM-4.5 Air adds tool support, reasoning; core performance unchanged

GLM-4.5 Air has expanded its capabilities with the addition of JSON mode, tool calling, and reasoning features, marking a significant enhancement to its functional toolkit. However, performance metrics across core tasks remain largely consistent with the previous benchmark window. The model continues to demonstrate strong competency in coding tasks while showing weaknesses in creative writing domains. The addition of tool support positions GLM-4.5 Air as more versatile for enterprise and application development scenarios, enabling function calling and structured output generation that were previously unavailable. The reasoning capability suggests potential for more complex problem-solving workflows, though benchmark scores indicate the fundamental quality of outputs has not shifted dramatically. Users evaluating this model should note that while the feature set has grown substantially, making it suitable for a broader range of use cases, the underlying performance characteristics remain steady. Creative writing tasks still represent a relative weakness compared to technical applications. The expanded capabilities make GLM-4.5 Air a more complete offering for developers seeking structured interactions and tool integration, while those prioritizing creative or narrative generation may still find limitations.

Quality

Latency p50

Test runs

0

JSON and tool support added New reasoning capability introduced Creative writing remains weak Core performance metrics unchanged
Sectie 08

Volledig modelprofiel

GLM-4.5 Air: de lichtgewicht, goedkope GLM

GLM-4.5 Air is het lichtgewicht broertje van GLM-4.5 — een kleiner, goedkoper model afgestemd op snelheid en volume. Het is de GLM waar je naar grijpt wanneer kosten-per-token en doorvoer belangrijker zijn dan piekkwaliteit.

z.ai publiceert GLM-4.5 Air voor $0,20 per 1M invoertokens en $1,10 per 1M uitvoertokens — de goedkoopste betaalde GLM-laag, ruim onder de standaard GLM-4.5.

Het adverteert een 128K-token contextvenster.

Architectuur & trainingssignalen

GLM-4.5 Air is de kleinere, op efficiëntie gerichte variant van GLM-4.5 van Zhipu AI. Het behoudt tool-aanroepen en JSON-ondersteuning in een lichter pakket gericht op doorvoer en kosten, via een OpenAI-compatibel eindpunt. Zoals de rest van de GLM-lijn levert het een niet-standaard reasoning_content-veld naast content; integraties moeten content lezen voor het uiteindelijke antwoord en reasoning_content als optioneel spoor behandelen.

Waar het uitblinkt

  • Hoogvolume-, kostengevoelige werklasten — classificatie, extractie, bulk-opstellen.
  • Lagere latentie dan de volledige GLM-4.5.
  • Het laagste betaalde GLM-prijspunt.

Waar het tekortschiet

  • Lager plafond dan de volwaardige modellen — niet voor het zwaarste redeneerwerk.
  • Nog geen Tokonomix-benchmarkdata; valideer op je eigen taken.
  • Niet-EU-hosting.

Praktijkvoorbeelden

  • Bulk-gegevensverwerking waar kosten domineren.
  • Interactieve features die snelle, goedkope antwoorden nodig hebben.
  • Een eerste-opzet-conceptversie voordat een sterker model verfijnt.

Tokonomix-benchmarkmomentopname

GLM-4.5 Air is nieuw geregistreerd op Tokonomix en nog niet geactiveerd, dus we hebben het nog niet door onze wekelijkse intelligentietest of snelheidsbenchmark gehaald. Er zijn nog geen Tokonomix-scores om te melden — en we verzinnen ze niet.

Zodra het live gaat, komt het in dezelfde wekelijkse harnas als elk ander model: identieke prompts, een onafhankelijke cross-family-jury en reproduceerbare latentie- en kostenmetingen. Behandel tot die tijd de prijs- en capaciteitsnotities op deze pagina als het door de leverancier opgegeven startpunt, niet als gemeten Tokonomix-resultaten.

EU-privacy & dataresidentie

GLM-4.5 Air is gebouwd door Zhipu AI (z.ai), een lab met hoofdkantoor in China, en wordt geserveerd vanaf niet-EU-infrastructuur. Dit moeten we duidelijk stellen: een prompt naar dit model sturen is geen keuze voor EU-dataresidentie of GDPR-soevereiniteit, en Tokonomix zal het nooit als zodanig bestempelen.

Als uw gebruikssituatie vereist dat data binnen de EU blijft, kies dan een EU-gehost model (bijvoorbeeld onze OVH- of Azure-EU-routes) in plaats van een GLM-model. Tokonomix houdt z.ai standaard buiten elke EU-only/soevereine routeringsset. Gebruik GLM waar de capaciteit of prijs de prioriteit is en grensoverschrijdende verwerking voor die taak aanvaardbaar is.

Oordeel & alternatieven

GLM-4.5 Air is de GLM-economylaag: goedkoop en snel, met een verstandig lager plafond. Wanneer kosten nog zwaarder wegen, zijn de GLM-4.7/4.5 Flash-lagen gratis; wanneer kwaliteit zwaarder weegt, stap je op naar de volledige GLM-4.5 of hoger.

Laatste automatische test
22 jul 2026 · 08:00 UTC · Snelheidstest
P50 latency
4376 ms
P95 latency
15384 ms
Fouten
0 / 6 runs
Laatst beoordeeld door Tokonomix-team·8 juli 2026