GLM-4.6V ist das vision-fähige Modell der GLM-4.6-Reihe: Es akzeptiert Bilder neben Text und räsoniert über beide. Es verbindet multimodales Verständnis mit dem großen Kontextfenster der GLM-4.6-Reihe zu einem auffällig niedrigen Preis.
z.ai veröffentlicht GLM-4.6V zu $0,30 pro 1M Eingabe-Tokens und $0,90 pro 1M Ausgabe-Tokens — ein aggressiv niedriger Preis für ein vision-fähiges Modell.
Es wirbt mit einem großen ~200K-Token-Kontextfenster, sodass Bilder mit umfangreichem Text in einem einzigen Aufruf kombiniert werden können.
Architektur & Trainingssignale
GLM-4.6V ist die Vision-Variante von Zhipu AIs GLM-4.6. Es erweitert das Textmodell um Bildeingabe und liefert Textausgabe, die über die bereitgestellten Bilder räsoniert. Es bietet Tool-Aufrufe und JSON über ein OpenAI-kompatibles Endpoint. Die Ausgabemodalität ist Text (es beschreibt/räsoniert über Bilder, es generiert sie nicht). Wie der Rest der GLM-Reihe liefert es ein nicht standardmäßiges reasoning_content-Feld neben content; Integrationen sollten content für die endgültige Antwort lesen und reasoning_content als optionale Spur behandeln.
Wo es glänzt
- Bildverständnis — Beschreiben, Vergleichen, Extrahieren von Informationen aus Fotos und Screenshots.
- Kombination von Bildern mit langem Textkontext in einem einzigen Aufruf.
- Sehr niedriger Preis für ein multimodales Modell.
Wo es schwächelt
- Es liest Bilder, es generiert sie nicht — für Bildgenerierung nutzen Sie z.ais GLM-Image-/CogView-Modelle.
- Noch keine Tokonomix-Benchmark-Daten; prüfen Sie die Vision-Qualität an eigenen Bildern.
- Nicht-EU-Hosting.
Anwendungsfälle aus der Praxis
- Dokumenten-, Diagramm- und Screenshot-Verständnis.
- Visuelle Frage-Antwort und multimodale Analyse im großen Maßstab.
- Ein günstiger Vision-Proposer in einem multimodalen Konsens-Panel.
Tokonomix-Benchmark-Momentaufnahme
GLM-4.6V ist neu bei Tokonomix registriert und noch nicht aktiviert, daher haben wir es noch nicht durch unseren wöchentlichen Intelligenztest oder Geschwindigkeits-Benchmark laufen lassen. Es gibt noch keine Tokonomix-Werte zu berichten — und wir erfinden keine.
Sobald es live geht, durchläuft es dieselbe wöchentliche Testumgebung wie jedes andere Modell: identische Prompts, ein unabhängiger, familienfremder Judge und reproduzierbare Latenz- und Kostenmessungen. Behandeln Sie bis dahin die Preis- und Fähigkeitsangaben auf dieser Seite als vom Anbieter veröffentlichten Ausgangspunkt, nicht als gemessene Tokonomix-Ergebnisse.
EU-Datenschutz & Datenresidenz
GLM-4.6V wird von Zhipu AI (z.ai) entwickelt, einem Labor mit Sitz in China, und von Nicht-EU-Infrastruktur aus bereitgestellt. Das muss klar gesagt werden: einen Prompt an dieses Modell zu senden ist keine Entscheidung für EU-Datenresidenz oder DSGVO-Souveränität, und Tokonomix wird es nie als solche kennzeichnen.
Wenn Ihr Anwendungsfall erfordert, dass Daten in der EU bleiben, wählen Sie ein EU-gehostetes Modell (etwa unsere OVH- oder Azure-EU-Routen) statt eines GLM-Modells. Tokonomix hält z.ai standardmäßig aus jedem EU-only-/souveränen Routing-Set heraus. Nutzen Sie GLM dort, wo Fähigkeit oder Preis im Vordergrund stehen und grenzüberschreitende Verarbeitung für diese Aufgabe akzeptabel ist.
Fazit & Alternativen
GLM-4.6V ist ein Vision-Modell mit starkem Preis-Leistungs-Verhältnis: multimodales Verständnis plus langer Kontext zu niedrigem Preis. Für eine kostenlose Vision-Option GLM-4.6V Flash; für Bildgenerierung (kein Verständnis) die GLM-Image-/CogView-Modelle.