GLM-4.5 Air est le petit frère léger de GLM-4.5 — un modèle plus petit et moins cher, réglé pour la vitesse et le volume. C’est la GLM vers laquelle se tourner quand le coût par token et le débit comptent plus que la qualité maximale.
z.ai publie GLM-4.5 Air à 0,20 $ par 1M de tokens d’entrée et 1,10 $ par 1M de tokens de sortie — le palier GLM payant le moins cher, bien en dessous du GLM-4.5 standard.
Il annonce une fenêtre de contexte de 128K tokens.
Architecture et signaux d’entraînement
GLM-4.5 Air est la variante plus petite et orientée efficacité de GLM-4.5 de Zhipu AI. Il conserve l’appel d’outils et la prise en charge JSON dans un paquet plus léger visant le débit et le coût, via un point de terminaison compatible OpenAI. Comme le reste de la gamme GLM, il renvoie un champ non standard reasoning_content à côté de content ; les intégrations doivent lire content pour la réponse finale et traiter reasoning_content comme une trace facultative.
Là où il excelle
- Charges de travail à fort volume et sensibles au coût — classification, extraction, rédaction en masse.
- Latence plus faible que le GLM-4.5 complet.
- Le point de prix GLM payant le plus bas.
Là où il pèche
- Plafond plus bas que les modèles complets — pas pour le raisonnement le plus difficile.
- Pas encore de données de benchmark Tokonomix ; validez sur vos tâches.
- Hébergement hors UE.
Cas d’usage concrets
- Traitement de données en masse où le coût domine.
- Fonctionnalités interactives nécessitant des réponses rapides et bon marché.
- Une première ébauche avant qu’un modèle plus puissant ne l’affine.
Instantané du benchmark Tokonomix
GLM-4.5 Air est récemment enregistré sur Tokonomix et pas encore activé, nous ne l’avons donc pas encore soumis à notre test d’intelligence hebdomadaire ni à notre benchmark de vitesse. Il n’y a pas encore de scores Tokonomix à communiquer — et nous n’en inventerons pas.
Dès sa mise en service, il entre dans le même dispositif hebdomadaire que tous les autres modèles : prompts identiques, juge indépendant d’une autre famille, et mesures reproductibles de latence et de coût. D’ici là, considérez les indications de prix et de capacités de cette page comme le point de départ publié par le fournisseur, et non comme des résultats mesurés par Tokonomix.
Confidentialité UE et résidence des données
GLM-4.5 Air est développé par Zhipu AI (z.ai), un laboratoire dont le siège est en Chine, et servi depuis une infrastructure hors UE. Il faut le dire clairement : envoyer un prompt à ce modèle n’est pas un choix de résidence des données dans l’UE ni de souveraineté RGPD, et Tokonomix ne l’étiquettera jamais comme tel.
Si votre cas d’usage exige que les données restent dans l’UE, choisissez un modèle hébergé dans l’UE (par exemple nos routes OVH ou Azure-EU) plutôt qu’un modèle GLM. Tokonomix maintient z.ai en dehors de tout ensemble de routage UE-uniquement/souverain par conception. Utilisez GLM là où la capacité ou le prix priment et où un traitement transfrontalier est acceptable pour cette tâche.
Verdict et alternatives
GLM-4.5 Air est le palier économique de GLM : bon marché et rapide, avec un plafond sensiblement plus bas. Quand le coût compte encore plus, les paliers GLM-4.7/4.5 Flash sont gratuits ; quand la qualité compte plus, passez au GLM-4.5 complet ou supérieur.