El nuevo modelo GLM-5.3-Flash, lanzado por Z.ai, ha demostrado un rendimiento notable en el Intelligence Index, alcanzando 57 puntos. Este modelo cuenta con 320 mil millones de parámetros y ofrece un costo por tarea de solo 0.09 dólares, lo que lo hace aproximadamente 7.5 veces más asequible que su predecesor, el GLM-5.3, que tiene un costo de 0.68 dólares por tarea.
Con un contexto de un millón de tokens, GLM-5.3-Flash es el primer modelo multimodal nativo en la serie GLM-5. Además, ha sido ejecutado completamente en chips de IA chinos, lo que resalta una tendencia creciente hacia la competitividad de los modelos chinos frente a los proveedores occidentales. En tareas de rendimiento, el nuevo modelo empata en puntajes Elo con GLM-5.3 y Grok 4.6, solo detrás de Claude Opus 5.
La capacidad del modelo ha sido impresionante, alcanzando 100 billones de tokens diarios durante pruebas previas al lanzamiento, lo que lo convierte en un competidor fuerte en el mercado de la inteligencia artificial. Con un enfoque en la eficiencia de costos, Z.ai está posicionando su tecnología para desafiar a los líderes establecidos en la industria.