GLM-4.5 Air es el hermano ligero de GLM-4.5 — un modelo más pequeño y barato, ajustado para la velocidad y el volumen. Es la GLM a la que recurrir cuando el coste por token y el rendimiento importan más que la calidad máxima.
z.ai publica GLM-4.5 Air a 0,20 $ por 1M de tokens de entrada y 1,10 $ por 1M de tokens de salida — el nivel GLM de pago más barato, muy por debajo del GLM-4.5 estándar.
Anuncia una ventana de contexto de 128K tokens.
Arquitectura y señales de entrenamiento
GLM-4.5 Air es la variante más pequeña y orientada a la eficiencia de GLM-4.5 de Zhipu AI. Mantiene la llamada a herramientas y el soporte de JSON en un paquete más ligero orientado al rendimiento y al coste, a través de un endpoint compatible con OpenAI. Como el resto de la gama GLM, devuelve un campo no estándar reasoning_content junto a content; las integraciones deben leer content para la respuesta final y tratar reasoning_content como una traza opcional.
Dónde destaca
- Cargas de trabajo de alto volumen y sensibles al coste — clasificación, extracción, redacción masiva.
- Menor latencia que el GLM-4.5 completo.
- El punto de precio GLM de pago más bajo.
Dónde se queda corto
- Techo más bajo que los modelos completos — no apto para el razonamiento más difícil.
- Aún no hay datos de benchmark de Tokonomix; valida en tus propias tareas.
- Alojamiento fuera de la UE.
Casos de uso reales
- Procesamiento de datos masivo donde el coste domina.
- Funciones interactivas que necesitan respuestas rápidas y baratas.
- Un primer borrador antes de que un modelo más fuerte lo refine.
Instantánea del benchmark de Tokonomix
GLM-4.5 Air está recién registrado en Tokonomix y aún no activado, por lo que todavía no lo hemos sometido a nuestra prueba de inteligencia semanal ni a nuestro benchmark de velocidad. Aún no hay puntuaciones de Tokonomix que informar — y no las inventaremos.
Cuando se active, entra en el mismo banco de pruebas semanal que cualquier otro modelo: prompts idénticos, un juez independiente de otra familia y mediciones reproducibles de latencia y coste. Hasta entonces, trate las notas de precio y capacidad de esta página como el punto de partida publicado por el proveedor, no como resultados medidos por Tokonomix.
Privacidad en la UE y residencia de datos
GLM-4.5 Air está desarrollado por Zhipu AI (z.ai), un laboratorio con sede en China, y se sirve desde infraestructura fuera de la UE. Conviene decirlo con claridad: enviar un prompt a este modelo no es una opción de residencia de datos en la UE ni de soberanía RGPD, y Tokonomix nunca lo etiquetará como tal.
Si su caso de uso exige que los datos permanezcan dentro de la UE, elija un modelo alojado en la UE (por ejemplo nuestras rutas OVH o Azure-EU) en lugar de un modelo GLM. Tokonomix mantiene a z.ai fuera de cualquier conjunto de enrutamiento solo-UE/soberano por diseño. Use GLM donde la capacidad o el precio sean la prioridad y el procesamiento transfronterizo sea aceptable para esa tarea.
Veredicto y alternativas
GLM-4.5 Air es el nivel económico de GLM: barato y rápido, con un techo sensatamente más bajo. Cuando el coste importa aún más, los niveles GLM-4.7/4.5 Flash son gratuitos; cuando la calidad importa más, sube al GLM-4.5 completo o superior.