Transparencia
Z.ai lanza GLM-5.3-Flash, primer modelo multimodal de la serie GLM-5 con costes rebajados
Afirmaciones verificadas
El coste por API para GLM-5.3-Flash es de 0,15 $/M para entrada, 0,03 $/M para entrada en caché y 0,50 $/M para salida.
Estado: Verificada (fuente primaria)
El modelo está completamente disponible en el GLM Coding Plan y en plataformas oficiales como Hugging Face y ZCode.
Estado: Verificada (fuente primaria)
El modelo está en ZCode y la página en Product Hunt indica un lanzamiento en torno al 26 de agosto de 2026.
Estado: Verificada (fuente primaria)
El modelo presenta una ventana de contexto de 1 millón de tokens.
Estado: Verificada (fuente primaria)
El uso en ZCode del modelo ofrece 3 veces la cuota de uso respecto a versiones anteriores, y opera a una décima parte del coste en comparación con alternativas citadas por Z.ai.
Estado: Verificada (fuente primaria)
GLM-5.3-Flash es el primer modelo multimodal nativo de la serie GLM-5.
Estado: Verificada (fuente primaria)
GLM-5.3-Flash es el primer modelo nativamente multimodal de la serie GLM-5.
Estado: Verificada (fuente primaria)
La arquitectura oficial del modelo es de 320 mil millones de parámetros totales y 18 mil millones de activados por token.
Estado: Verificada (fuente primaria)
La licencia declarada del modelo es MIT.
Estado: Verificada (fuente primaria)
La tarifa promocional hasta el 9 de septiembre de 2026 es de 0,075 dólares por millón de tokens de entrada y 0,25 dólares por millón de tokens de salida.
Estado: Verificada (fuente primaria)
Z.ai lanzó oficialmente el modelo multimedial GLM-5.3-Flash el 26 de agosto de 2026.
Estado: Verificada (fuente primaria)
Z.ai publicó el 26 de agosto de 2026 el modelo multimodal GLM-5.3-Flash.
Estado: Verificada (fuente primaria)