Naar inhoud
Tier A — Frontier
Draait in:CNGemaakt in:China
Z.ai (GLM / Zhipu)

GLM-5.1

Tier A — Frontier · 205K tokens

Tokonomix-redactie·Gecontroleerd door Mes Kalkan··

GLM-5.1 bevindt zich binnen Zhipu’s GLM-5-generatie, tussen de GLM-5-basis en het GLM-5.2-vlaggenschip in. Het is bereikbaar via z.ai als een OpenAI-compatibel redeneer-chatmodel. We registreren het eerlijk met de details die we kunnen verifiëren, en markeren wat we niet kunnen verifiëren.

Sectie 01

Snelheidsanalyse

Latency gemeten over alle benchmark-runs. P50 (mediaan) en P95 (95e percentiel) geven een realistisch beeld van de responssnelheid onder normale en piekbelasting.

P50 latency (mediaan)P95 latency57 runs
1821684711872168982192307-0807-22ms
Sectie 02

Kwaliteitsscores

Evaluatieresultaten van judge-model beoordelingen over diverse taakcategorieën. Scores weerspiegelen coherentie, accuratesse en instructieopvolging.

58
Code generatie
45
Creatief
Sectie 03

Prijsgeschiedenis

Directe provider-tarieven per miljoen tokens, plus een typische gespreks-kostschatting.

💰
API-tarieven — GLM-5.1
$1.40 per 1M input-tokens
$4.40 per 1M output-tokens
≈ $0.0017 per typisch gesprek (800 tokens)
Input vs output prijs (per 1M tokens)
per 1M input-tokens$1.40
per 1M output-tokens$4.40

Pricing over time

Input & output per 1M tokens · step-line = price changes

$1.40

input / 1M

— stable

$4.40

output / 1M

— stable

2026-07-122026-07-192026-07-19
Input
Output
Price change
⟳ synced weekly
Sectie 04

Tokens per seconde

Doorvoersnelheid in tokens per seconde, afgeleid uit gemeten P50-latency. Hogere waarden zijn beter; fluctuaties weerspiegelen serverbelasting bij de provider.

Doorvoer (tokens / s)77 / avg 64
10915

Geschat uit P50-latency × 200 output-tokens — het absolute getal hangt af van deze aanname; de trend is wat telt.

Sectie 05

Mogelijkheden

jsonnotes: GLM emits a non-standard reasoning_content field beside content; read content for the answer.toolsreasoningprice note: No published price on 2026-07-06
Sectie 06

Beschikbaarheid

Beschikbaarheid

Hoe vaak dit model antwoordt als we het aanroepen — gemeten over echte API-aanvragen en live-tests in de afgelopen 30 dagen. Dit staat los van kwaliteit: deze cijfers laten alleen zien of het model reageert, niet hoe goed het antwoord is.

Afgelopen 7 dagen

Afgelopen 30 dagen

100.0%

n=1

Mediane responstijd

6,441ms

n=1

Gebaseerd op 178 metingen in de afgelopen 30 dagen.

Technische details

Alleen echte API-aanroepen en live-testverzoeken tellen mee — interne probes en benchmarkruns zijn uitgesloten.

Aanroepen met een eigen API-sleutel (BYOK) zijn uitgesloten: die fouten zijn sleutelspecifiek en geen teken van modelneergang.

Mislukte aanroepen worden NIET meegeteld in kwaliteitsscores — kwaliteit wordt gemeten op geslaagde responses. Beschikbaarheid en kwaliteit zijn onafhankelijke signalen.

Mediane responstijd (p50) over geslaagde aanroepen met een vastgelegde duur. Uitschieters trekken de mediaan minder dan het gemiddelde.

Totaal aanroepen (30d)

1

OK-reacties (30d)

1

Totaal aanroepen (7d)

0

OK-reacties (7d)

0

Sectie 07

Tokonomix benchmark-oordelen

⚖️
Endorsed by 1 judge
Independent LLM judges evaluated this model on our weekly intelligence tests
claude-sonnet-4-541/100 · 6 runs
1 correct1 partial4 wrong17% accuracy
2026-07-19

GLM-5.1 adds reasoning, tools, and JSON with multimodal capabilities

GLM-5.1 has expanded significantly since its debut, introducing structured output support through JSON mode, function calling tools, and a dedicated reasoning mode. These additions transform the model from a strong general-purpose system into a more versatile platform for production applications. The model now supports vision capabilities alongside its established text processing strengths, though benchmark performance data for these new modalities remains limited in the current window. Previous testing showed GLM-5.1 delivering competitive coding performance and excellent multilingual support, particularly for Chinese language tasks. The addition of reasoning mode suggests the model can now tackle more complex multi-step problems with chain-of-thought approaches. Tool calling functionality enables integration with external systems and APIs, addressing a critical gap for enterprise deployments. JSON mode provides reliable structured output generation for downstream processing. While the core model capabilities appear stable, the rapid addition of these features indicates active development. Users should expect a model that balances strong foundational performance with expanding practical utility, though comprehensive benchmarks of the new capabilities would help validate their production readiness across diverse use cases.

Quality

Latency p50

Test runs

0

Added reasoning mode capability Function calling tools introduced JSON structured output support Vision capabilities now available
Sectie 08

Volledig modelprofiel

GLM-5.1: een model uit de GLM-5-generatie op z.ai

GLM-5.1 bevindt zich binnen Zhipu’s GLM-5-generatie, tussen de GLM-5-basis en het GLM-5.2-vlaggenschip in. Het is bereikbaar via z.ai als een OpenAI-compatibel redeneer-chatmodel. We registreren het eerlijk met de details die we kunnen verifiëren, en markeren wat we niet kunnen verifiëren.

z.ai had op het moment van registratie (juli 2026) geen publieke prijs voor GLM-5.1 gepubliceerd, dus we slaan er geen facturatiecijfers voor op. Bevestig het huidige tarief op z.ai voordat je het activeert.

We registreerden het met een groot (~200K-token) contextvenster als voorlopige waarde; documentatie over de GLM-5-generatie is schaars, dus bevestig het exacte venster op z.ai voordat je erop vertrouwt.

Architectuur & trainingssignalen

GLM-5.1 maakt deel uit van de GLM-5-generatie van Zhipu AI. Zoals bij de rest van de GLM-5-serie is diepgaande openbare technische documentatie per juli 2026 beperkt. We beschouwen het als een groot, op redeneren gericht chatmodel met tool- en JSON-ondersteuning via een OpenAI-compatibel eindpunt. Zoals de rest van de GLM-lijn levert het een niet-standaard reasoning_content-veld naast content; integraties moeten content lezen voor het uiteindelijke antwoord en reasoning_content als optioneel spoor behandelen.

Waar het uitblinkt

  • Algemeen redeneren en lange-contexttaken binnen de GLM-5-generatie.
  • Een cross-family alternatief voor Amerikaanse frontier-modellen in een consensuspanel.
  • Tool-aanroepen en gestructureerde JSON-uitvoer.

Waar het tekortschiet

  • Geen gepubliceerde prijs bij registratie — activeer pas na bevestiging van het huidige tarief.
  • Schaarse onafhankelijke benchmarkdekking; valideer op je eigen taken.
  • Niet-EU-hosting.

Praktijkvoorbeelden

  • Een gedecorreleerde tweede mening in multimodel-consensus.
  • Analyse en samenvatting van lange documenten.
  • Agentische taken die tool-aanroepen nodig hebben.

Tokonomix-benchmarkmomentopname

GLM-5.1 is nieuw geregistreerd op Tokonomix en nog niet geactiveerd, dus we hebben het nog niet door onze wekelijkse intelligentietest of snelheidsbenchmark gehaald. Er zijn nog geen Tokonomix-scores om te melden — en we verzinnen ze niet.

Zodra het live gaat, komt het in dezelfde wekelijkse harnas als elk ander model: identieke prompts, een onafhankelijke cross-family-jury en reproduceerbare latentie- en kostenmetingen. Behandel tot die tijd de prijs- en capaciteitsnotities op deze pagina als het door de leverancier opgegeven startpunt, niet als gemeten Tokonomix-resultaten.

EU-privacy & dataresidentie

GLM-5.1 is gebouwd door Zhipu AI (z.ai), een lab met hoofdkantoor in China, en wordt geserveerd vanaf niet-EU-infrastructuur. Dit moeten we duidelijk stellen: een prompt naar dit model sturen is geen keuze voor EU-dataresidentie of GDPR-soevereiniteit, en Tokonomix zal het nooit als zodanig bestempelen.

Als uw gebruikssituatie vereist dat data binnen de EU blijft, kies dan een EU-gehost model (bijvoorbeeld onze OVH- of Azure-EU-routes) in plaats van een GLM-model. Tokonomix houdt z.ai standaard buiten elke EU-only/soevereine routeringsset. Gebruik GLM waar de capaciteit of prijs de prioriteit is en grensoverschrijdende verwerking voor die taak aanvaardbaar is.

Oordeel & alternatieven

GLM-5.1 is een middenpunt van de GLM-5-generatie. Omdat de prijs onbekend was bij registratie, behandel activatie als een bewuste stap: bevestig eerst het tarief. Wil je gewoonweg de nieuwste GLM-kwaliteit, dan is GLM-5.2 het gedocumenteerde vlaggenschip; voor waarde GLM-4.7/4.6.

Laatste automatische test
22 jul 2026 · 08:04 UTC · Snelheidstest
P50 latency
2592 ms
P95 latency
4283 ms
Fouten
0 / 6 runs
Laatst beoordeeld door Tokonomix-team·8 juli 2026