GLM-4.5 Air ist das leichtgewichtige Geschwister von GLM-4.5 — ein kleineres, günstigeres Modell, abgestimmt auf Geschwindigkeit und Volumen. Es ist die GLM, zu der man greift, wenn Kosten pro Token und Durchsatz wichtiger sind als Spitzenqualität.
z.ai veröffentlicht GLM-4.5 Air zu $0,20 pro 1M Eingabe-Tokens und $1,10 pro 1M Ausgabe-Tokens — die günstigste kostenpflichtige GLM-Stufe, deutlich unter der Standard-GLM-4.5.
Es wirbt mit einem 128K-Token-Kontextfenster.
Architektur & Trainingssignale
GLM-4.5 Air ist die kleinere, auf Effizienz ausgerichtete Variante von GLM-4.5 von Zhipu AI. Es behält Tool-Aufrufe und JSON-Unterstützung in einem leichteren, auf Durchsatz und Kosten ausgerichteten Paket über einen OpenAI-kompatiblen Endpunkt bei. Wie der Rest der GLM-Reihe liefert es ein nicht standardmäßiges reasoning_content-Feld neben content; Integrationen sollten content für die endgültige Antwort lesen und reasoning_content als optionale Spur behandeln.
Wo es glänzt
- Hochvolumen-, kostensensitive Arbeitslasten — Klassifizierung, Extraktion, Massen-Entwürfe.
- Geringere Latenz als das vollständige GLM-4.5.
- Der günstigste kostenpflichtige GLM-Preispunkt.
Wo es schwächelt
- Niedrigeres Limit als die vollwertigen Modelle — nicht für das schwierigste Reasoning.
- Noch keine Tokonomix-Benchmark-Daten; validieren Sie an Ihren eigenen Aufgaben.
- Nicht-EU-Hosting.
Anwendungsfälle aus der Praxis
- Massenhafte Datenverarbeitung, bei der Kosten dominieren.
- Interaktive Funktionen, die schnelle, günstige Antworten benötigen.
- Ein erster Entwurf, bevor ein stärkeres Modell verfeinert.
Tokonomix-Benchmark-Momentaufnahme
GLM-4.5 Air ist neu bei Tokonomix registriert und noch nicht aktiviert, daher haben wir es noch nicht durch unseren wöchentlichen Intelligenztest oder Geschwindigkeits-Benchmark laufen lassen. Es gibt noch keine Tokonomix-Werte zu berichten — und wir erfinden keine.
Sobald es live geht, durchläuft es dieselbe wöchentliche Testumgebung wie jedes andere Modell: identische Prompts, ein unabhängiger, familienfremder Judge und reproduzierbare Latenz- und Kostenmessungen. Behandeln Sie bis dahin die Preis- und Fähigkeitsangaben auf dieser Seite als vom Anbieter veröffentlichten Ausgangspunkt, nicht als gemessene Tokonomix-Ergebnisse.
EU-Datenschutz & Datenresidenz
GLM-4.5 Air wird von Zhipu AI (z.ai) entwickelt, einem Labor mit Sitz in China, und von Nicht-EU-Infrastruktur aus bereitgestellt. Das muss klar gesagt werden: einen Prompt an dieses Modell zu senden ist keine Entscheidung für EU-Datenresidenz oder DSGVO-Souveränität, und Tokonomix wird es nie als solche kennzeichnen.
Wenn Ihr Anwendungsfall erfordert, dass Daten in der EU bleiben, wählen Sie ein EU-gehostetes Modell (etwa unsere OVH- oder Azure-EU-Routen) statt eines GLM-Modells. Tokonomix hält z.ai standardmäßig aus jedem EU-only-/souveränen Routing-Set heraus. Nutzen Sie GLM dort, wo Fähigkeit oder Preis im Vordergrund stehen und grenzüberschreitende Verarbeitung für diese Aufgabe akzeptabel ist.
Fazit & Alternativen
GLM-4.5 Air ist die GLM-Economy-Stufe: günstig und schnell, mit einem sinnvoll niedrigeren Limit. Wenn Kosten noch mehr zählen, sind die GLM-4.7/4.5-Flash-Stufen kostenlos; wenn Qualität mehr zählt, steigen Sie auf das vollständige GLM-4.5 oder höher um.