Z.ai lanzó GLM-5.3-Flash el 26 de agosto de 2026: un modelo de mezcla de expertos (MoE) con pesos abiertos bajo licencia MIT, contexto de un millón de tokens y entrada nativa de imagen y video — que según los benchmarks de la propia compañía queda a medio punto de Claude Opus 4.8 en su prueba interna de código, a aproximadamente un décimo del precio.
GLM-5.3-Flash tiene 320,000 millones de parámetros totales con 18,000 millones activos por token, entrenado sobre un corpus multimodal de 30 billones de tokens. Combina atención lineal para dependencias locales con atención dispersa para contexto global relevante, y los pesos están publicados en Hugging Face. Es la primera entrada nativamente multimodal de la línea GLM-5 — antes de revelarse su nombre, circulaba sin marca en OpenCode y OpenRouter bajo el alias "Ox Alpha".
Según Artificial Analysis, GLM-5.3-Flash obtiene 57 puntos en su índice de inteligencia, muy por encima de la mediana de 27 para modelos abiertos de tamaño similar. En benchmarks de visión como OfficeQA Pro alcanza 62.4, superando tanto a Opus 4.8 como a DeepSeek-V4-Vision-Exp, aunque queda detrás de Gemini 3.7 Flash en pruebas como BabyVision y MVBench. Z.ai reporta que supera a su predecesor GLM-5.2 en benchmarks y cargas de trabajo reales a aproximadamente un décimo del costo.
Carlos Montiel es arquitecto de soluciones IA empresarial. Implementa LLMs, Agentes, RAG y orquestadores en empresas de Guatemala y Latinoamérica. Contáctalo para una consultoría.
Contactar a Carlos Montiel