Zum Inhalt
Tier A — Frontier
Läuft in:CNErstellt in:China
Z.ai (GLM / Zhipu)

GLM-5.1

Tier A — Frontier · 205K Tokens

Tokonomix-Redaktionsteam·Geprüft von Mes Kalkan··

GLM-5.1 liegt innerhalb von Zhipus GLM-5-Generation, zwischen der GLM-5-Basis und dem GLM-5.2-Flaggschiff. Es ist über z.ai als OpenAI-kompatibles Reasoning-Chatmodell erreichbar. Wir registrieren es ehrlich mit den Details, die wir verifizieren können, und kennzeichnen, was wir nicht verifizieren können.

Abschnitt 01

Geschwindigkeitsanalyse

Latenz über alle Benchmark-Läufe gemessen. P50 (Median) und P95 (95. Perzentil) zeigen ein realistisches Bild der Antwortgeschwindigkeit bei normaler und Spitzenlast.

P50-Latenz (Median)P95-Latenz57 runs
1821684711872168982192307-0807-22ms
Abschnitt 02

Qualitätswerte

Auswertungsergebnisse aus Judge-Model-Bewertungen über verschiedene Aufgabenkategorien. Werte spiegeln Kohärenz, Genauigkeit und Anweisungsbefolgung wider.

58
Codegenerierung
45
Kreativ
Abschnitt 03

Preisverlauf

Direkte Provider-Tarife pro Million Tokens, plus eine typische Gesprächskostenschätzung.

💰
API-Tarife — GLM-5.1
$1.40 pro 1M Input-Tokens
$4.40 pro 1M Output-Tokens
≈ $0.0017 pro typischem Gespräch (800 Tokens)
Input- vs. Output-Preis (pro 1M Tokens)
pro 1M Input-Tokens$1.40
pro 1M Output-Tokens$4.40

Pricing over time

Input & output per 1M tokens · step-line = price changes

$1.40

input / 1M

— stable

$4.40

output / 1M

— stable

2026-07-122026-07-192026-07-19
Input
Output
Price change
⟳ synced weekly
Abschnitt 04

Tokens pro Sekunde

Durchsatz in Tokens pro Sekunde, abgeleitet aus gemessener P50-Latenz. Höhere Werte sind besser; Schwankungen spiegeln die Provider-seitige Last wider.

Durchsatz (Tokens / s)77 / avg 64
10915

Geschätzt aus P50-Latenz × 200 Output-Tokens — die absolute Zahl hängt von dieser Annahme ab; entscheidend ist der Trend.

Abschnitt 05

Fähigkeiten

jsonnotes: GLM emits a non-standard reasoning_content field beside content; read content for the answer.toolsreasoningprice note: No published price on 2026-07-06
Abschnitt 06

Verfügbarkeit

Verfügbarkeit

Wie oft dieses Modell antwortet, wenn wir es aufrufen — gemessen anhand echter API-Anfragen und Live-Tests der letzten 30 Tage. Dies ist unabhängig von der Qualität: Diese Zahlen zeigen nur, ob das Modell antwortet, nicht wie gut die Antwort ist.

Letzte 7 Tage

Letzte 30 Tage

100.0%

n=1

Mediane Antwortzeit

6,441ms

n=1

Basierend auf 175 Messungen in den letzten 30 Tagen.

Technische Details

Nur echte API-Aufrufe und Live-Test-Anfragen werden gezählt — interne Proben und Benchmark-Läufe sind ausgeschlossen.

Aufrufe mit einem eigenen API-Schlüssel (BYOK) sind ausgeschlossen: Diese Fehler sind schlüsselspezifisch und kein Zeichen für Modellausfälle.

Fehlgeschlagene Aufrufe werden NICHT in Qualitätswerten berücksichtigt — Qualität wird nur für erfolgreiche Antworten gemessen. Verfügbarkeit und Qualität sind unabhängige Signale.

Mediane Antwortzeit (p50) über erfolgreiche Aufrufe mit aufgezeichneter Dauer. Ausreißer beeinflussen den Median weniger als den Durchschnitt.

Gesamte Aufrufe (30d)

1

OK-Antworten (30d)

1

Gesamte Aufrufe (7d)

0

OK-Antworten (7d)

0

Abschnitt 07

Tokonomix-Benchmark-Urteile

⚖️
Endorsed by 1 judge
Independent LLM judges evaluated this model on our weekly intelligence tests
claude-sonnet-4-541/100 · 6 runs
1 correct1 partial4 wrong17% accuracy
2026-07-19

GLM-5.1 adds reasoning, tools, and JSON with multimodal capabilities

GLM-5.1 has expanded significantly since its debut, introducing structured output support through JSON mode, function calling tools, and a dedicated reasoning mode. These additions transform the model from a strong general-purpose system into a more versatile platform for production applications. The model now supports vision capabilities alongside its established text processing strengths, though benchmark performance data for these new modalities remains limited in the current window. Previous testing showed GLM-5.1 delivering competitive coding performance and excellent multilingual support, particularly for Chinese language tasks. The addition of reasoning mode suggests the model can now tackle more complex multi-step problems with chain-of-thought approaches. Tool calling functionality enables integration with external systems and APIs, addressing a critical gap for enterprise deployments. JSON mode provides reliable structured output generation for downstream processing. While the core model capabilities appear stable, the rapid addition of these features indicates active development. Users should expect a model that balances strong foundational performance with expanding practical utility, though comprehensive benchmarks of the new capabilities would help validate their production readiness across diverse use cases.

Quality

Latency p50

Test runs

0

Added reasoning mode capability Function calling tools introduced JSON structured output support Vision capabilities now available
Abschnitt 08

Vollständiges Modellprofil

GLM-5.1: ein Modell der GLM-5-Generation auf z.ai

GLM-5.1 liegt innerhalb von Zhipus GLM-5-Generation, zwischen der GLM-5-Basis und dem GLM-5.2-Flaggschiff. Es ist über z.ai als OpenAI-kompatibles Reasoning-Chatmodell erreichbar. Wir registrieren es ehrlich mit den Details, die wir verifizieren können, und kennzeichnen, was wir nicht verifizieren können.

z.ai hatte zum Zeitpunkt unserer Registrierung (Juli 2026) keinen öffentlichen Preis für GLM-5.1 veröffentlicht, daher speichern wir dafür keine Abrechnungswerte. Bestätigen Sie den aktuellen Tarif auf z.ai, bevor Sie es aktivieren.

Wir haben es mit einem großen (~200K-Token-)Kontextfenster als vorläufigem Wert registriert; die Dokumentation zur GLM-5-Generation ist dünn, prüfen Sie daher das genaue Fenster bei z.ai, bevor Sie sich darauf verlassen.

Architektur & Trainingssignale

GLM-5.1 ist Teil der GLM-5-Generation von Zhipu AI. Wie beim Rest der GLM-5-Serie ist tiefgehende öffentliche technische Dokumentation Stand Juli 2026 begrenzt. Wir betrachten es als ein großes, reasoning-orientiertes Chatmodell mit Tool- und JSON-Unterstützung über einen OpenAI-kompatiblen Endpunkt. Wie der Rest der GLM-Reihe liefert es ein nicht standardmäßiges reasoning_content-Feld neben content; Integrationen sollten content für die endgültige Antwort lesen und reasoning_content als optionale Spur behandeln.

Wo es glänzt

  • Allgemeines Reasoning und Long-Context-Aufgaben innerhalb der GLM-5-Generation.
  • Eine familienübergreifende Alternative zu US-Frontier-Modellen in einem Konsens-Panel.
  • Tool-Aufrufe und strukturierte JSON-Ausgabe.

Wo es schwächelt

  • Kein veröffentlichter Preis bei Registrierung — erst nach Bestätigung des aktuellen Tarifs aktivieren.
  • Spärliche unabhängige Benchmark-Abdeckung; an eigenen Aufgaben validieren.
  • Nicht-EU-Hosting.

Anwendungsfälle aus der Praxis

  • Eine dekorrelierte zweite Meinung im Multi-Modell-Konsens.
  • Analyse und Zusammenfassung langer Dokumente.
  • Agentische Aufgaben, die Tool-Aufrufe benötigen.

Tokonomix-Benchmark-Momentaufnahme

GLM-5.1 ist neu bei Tokonomix registriert und noch nicht aktiviert, daher haben wir es noch nicht durch unseren wöchentlichen Intelligenztest oder Geschwindigkeits-Benchmark laufen lassen. Es gibt noch keine Tokonomix-Werte zu berichten — und wir erfinden keine.

Sobald es live geht, durchläuft es dieselbe wöchentliche Testumgebung wie jedes andere Modell: identische Prompts, ein unabhängiger, familienfremder Judge und reproduzierbare Latenz- und Kostenmessungen. Behandeln Sie bis dahin die Preis- und Fähigkeitsangaben auf dieser Seite als vom Anbieter veröffentlichten Ausgangspunkt, nicht als gemessene Tokonomix-Ergebnisse.

EU-Datenschutz & Datenresidenz

GLM-5.1 wird von Zhipu AI (z.ai) entwickelt, einem Labor mit Sitz in China, und von Nicht-EU-Infrastruktur aus bereitgestellt. Das muss klar gesagt werden: einen Prompt an dieses Modell zu senden ist keine Entscheidung für EU-Datenresidenz oder DSGVO-Souveränität, und Tokonomix wird es nie als solche kennzeichnen.

Wenn Ihr Anwendungsfall erfordert, dass Daten in der EU bleiben, wählen Sie ein EU-gehostetes Modell (etwa unsere OVH- oder Azure-EU-Routen) statt eines GLM-Modells. Tokonomix hält z.ai standardmäßig aus jedem EU-only-/souveränen Routing-Set heraus. Nutzen Sie GLM dort, wo Fähigkeit oder Preis im Vordergrund stehen und grenzüberschreitende Verarbeitung für diese Aufgabe akzeptabel ist.

Fazit & Alternativen

GLM-5.1 ist ein Mittelpunkt der GLM-5-Generation. Da der Preis bei der Registrierung unveröffentlicht war, behandeln Sie die Aktivierung als bewussten Schritt: bestätigen Sie zuerst den Tarif. Wollen Sie einfach die neueste GLM-Qualität, ist GLM-5.2 das dokumentierte Flaggschiff; für Preis-Leistung GLM-4.7/4.6.

Letzter automatisierter Test
22. Juli 2026 · 08:04 UTC · Geschwindigkeits-Benchmark
P50-Latenz
2592 ms
P95-Latenz
4283 ms
Fehler
0 / 6 Läufe
Zuletzt geprüft von Tokonomix-Team·8. Juli 2026