Z.ai's (formerly Zhipu AI) coding and agentic upgrade built on the same base model as GLM-5.2, with all gains coming from extended post-training (more executable environments, longer-horizon tasks, more RL compute). Claims the strongest open-weight coding performance to date, with large jumps on Terminal-Bench 3.0, DeepSWE v1.1, SWE-Marathon v1.1, and cybersecurity benchmarks like CyberGym and ExploitBench. Supports low, high, and max reasoning effort levels with a 1M-token context route.
Noch keine Anbieterdaten verfügbar.
Anbieterzuordnungen erscheinen hier, sobald sie verfügbar sind.
Veröffentlichte Ergebnisse mit Quelle. Herstellerangaben beruhen auf eigenen Evaluierungseinstellungen und sind zwischen Herstellern nicht direkt vergleichbar.
| Benchmark | Ergebnis | Quelle |
|---|---|---|
| Artificial Analysis Intelligence IndexAllgemein · max effort, as listed on 2026-10-01 | 45 | Artificial AnalysisUnabhängig |