Z.ai's (formerly Zhipu AI) coding and agentic upgrade built on the same base model as GLM-5.2, with all gains coming from extended post-training (more executable environments, longer-horizon tasks, more RL compute). Claims the strongest open-weight coding performance to date, with large jumps on Terminal-Bench 3.0, DeepSWE v1.1, SWE-Marathon v1.1, and cybersecurity benchmarks like CyberGym and ExploitBench. Supports low, high, and max reasoning effort levels with a 1M-token context route.
Aún no hay datos de proveedores.
Las asociaciones con proveedores aparecerán aquí cuando estén disponibles.
Resultados publicados con sus fuentes. Los resultados del fabricante usan su propia configuración de evaluación y no son comparables directamente entre fabricantes.
| Benchmark | Resultado | Fuente |
|---|---|---|
| Artificial Analysis Intelligence IndexGeneral · max effort, as listed on 2026-10-01 | 45 | Artificial AnalysisIndependiente |