Z.ai's (formerly Zhipu AI) coding and agentic upgrade built on the same base model as GLM-5.2, with all gains coming from extended post-training (more executable environments, longer-horizon tasks, more RL compute). Claims the strongest open-weight coding performance to date, with large jumps on Terminal-Bench 3.0, DeepSWE v1.1, SWE-Marathon v1.1, and cybersecurity benchmarks like CyberGym and ExploitBench. Supports low, high, and max reasoning effort levels with a 1M-token context route.
Данные о провайдерах пока недоступны.
Сопоставления с провайдерами появятся здесь, когда станут доступны.
Опубликованные результаты со ссылкой на источник. Результаты от вендора получены в его собственных условиях и напрямую между вендорами не сравнимы.
| Бенчмарк | Результат | Источник |
|---|---|---|
| Artificial Analysis Intelligence IndexОбщий · max effort, as listed on 2026-10-01 | 45 | Artificial AnalysisНезависимый |