Modelos / SEÑAL VERIFICADA

GLM-5.3 de Z.ai: el salto de post-training que lo pone arriba del open-weights en coding y ciber

Z.ai lanzó GLM-5.3 el 14 de agosto: comparte el modelo base de GLM-5.2 y todo el salto viene de post-training, lo que lo coloca como el modelo de pesos abiertos más capaz en coding y SOTA en descubrimiento de vulnerabilidades.

Portada estilo revista tech manga cyberpunk retro anos 90 en fondo negro: titulo GLM-5.3 en rojo con EL SALTO DE POST-TRAINING QUE LO PONE ARRIBA DEL OPEN-WEIGHTS EN CODING Y CIBER, protagonista masculino de manga con chaqueta Z.ai, brazo robotico y consolas de debug y threat analysis en cian, rojo y amarillo
SIG/GLMVERIFICADO · 2026-08-14

Modelosesencial

#modelos#agentes#código#seguridad

Z.ai (Zhipu AI) presentó GLM-5.3 el 14 de agosto. La novedad no es un modelo base nuevo: es cuánto se puede empujar un base estable con entrenamiento posterior. GLM-5.3 comparte el modelo base de GLM-5.2; la mejora entera proviene de post-training sobre slime, el framework open-source de RL scaling de la empresa (Megatron en entrenamiento, SGLang en rollout), con SAO con compaction para que las ganancias aguanten en tareas de largo horizonte.

En coding, Z.ai lo presenta como el modelo de pesos abiertos más capaz, con cerca de 50% de mejora sobre 5.2 en su benchmark interno Z.ai Code Bench. Alcanza SOTA de código abierto en Terminal Bench 3.0 y en Agents' Last Exam (ALE-CLI). En ciberseguridad, la capacidad ofensiva creció más rápido de lo previsto: GLM-5.3 es SOTA en CyberGym para descubrimiento de vulnerabilidades y duplica a 5.2 en ExploitBench. Z.ai canaliza esto en un ledger público de divulgación de vulnerabilidades.

Los pesos abiertos se liberan en unas dos semanas, tras terminar la evaluación y el hardening de seguridad. Ya corre en ZCode, Claude Code y OpenCode.

Lo que cambia para quien arma agentes:

  • Pensamiento en tres niveles: low, high, max. Deshabilitar el thinking ya no es soportado (breaking change de API).
  • Mismas estrategias de RL de 5.2, incluido SAO con compaction, para que las ganancias aguanten en tareas de largo horizonte.
  • GLM Coding Plan lo tiene desplegado a todos sus usuarios, con cuota por puntos y 50% de descuento fuera de hora pico.

Para más detalles: