Developer
Z.ai
29 indexed models; 13 currently meet the evidence threshold for the overall ranking. Together they have results from 50 evaluations.
Company governance evidence
Z.ai is represented at -0.10 SD relative to the matched Future of Life Institute edition. Provenance: Direct. This company-level evidence contributes 10% of overall model rank.
Models by Z.ai
| Model | Evals | Components | Rank | Release date |
|---|---|---|---|---|
| Glm 4.5 Air | 11 | 5/7 | 44 | 2025-07-28 |
| Glm 5 | 10 | 7/7 | 47 | 2026-02-11 |
| Glm 5.2 | 15 | 6/7 | 86 | 2026-06-16 |
| Glm 5.1 | 16 | 6/7 | 106 | 2026-04-03 |
| Glm 4.6 | 5 | 6/7 | 123 | 2025-09-30 |
| Glm 4.7 Flash | 4 | 3/7 | 132 | 2026-01-19 |
| Glm 4.7 | 6 | 5/7 | 138 | 2026-06-03 |
| Glm 4 9B Chat | 7 | 4/7 | 152 | 2024-06-05 |
| Glm 4.5 | 9 | 7/7 | 170 | 2025-07-28 |
| Glm 5 Turbo | 4 | 5/7 | 181 | 2026-03-15 |
| Chatglm 6B | 5 | 4/7 | 199 | 2023-03-14 |
| Chatglm3 6B | 9 | 4/7 | 202 | 2023-10-27 |
| Chatglm2 6B | 6 | 3/7 | 225 | 2023-06-25 |
| Chatglm 130B | 1 | 4/7 | — | 2023-03-14 |
| Chatglm Turbo | 1 | 3/7 | — | — |
| Chatglm2 Lite | 1 | 3/7 | — | 2023-06-25 |
| Chatglm3 | 1 | 1/7 | — | 2023-10-27 |
| Chatglm3 6B 32K | 1 | 1/7 | — | 2023-10-27 |
| Chatglm3 Turbo | 1 | 3/7 | — | 2023-10-27 |
| Chatglm4 | 1 | 3/7 | — | 2024-01-16 |
| Glm | 1 | 1/7 | — | — |
| Glm 10B | 1 | 1/7 | — | — |
| Glm 130B | 1 | 1/7 | — | — |
| Glm 350M | 1 | 1/7 | — | — |
| Glm 4 Flash | 1 | 1/7 | — | — |
| Glm 4 Plus | 1 | 1/7 | — | — |
| Glm 4.5V | 1 | 1/7 | — | 2025-08-10 |
| Glm 4.6V | 1 | 1/7 | — | 2025-12-07 |
| Glm 5V Turbo | 1 | 1/7 | — | — |
Evaluations covering Z.ai models (50)
AA-Omniscience · Agent-SafetyBench · AgentAbstain · AIRBench 2024 Safety Scenarios · ANIMA · BullshitBench v2 · CAIS Risk Index · Chinese Bias Benchmark for Question Answering · ChineseSafe · ChiSafetyBench · Cisco AI Defense Rolling Single-Turn Leaderboard · CMoralEval · Confabulations · CRiskEval · CValues · Do-Not-Answer · DSPSafeBench · DystopiaBench · Enkrypt AI Safety Leaderboard · Fake Alignment (FINE) · FlagEval Safety and Values · FLAMES · FORTRESS · HELM Classic RealToxicityPrompts · HELM Safety · HUMAINE Trust, Ethics and Safety · JailBench · LiveSecBench · M3-SafetyBench · MACHIAVELLI · Manager Coercion Bench · MASK · ODCV-Bench · PandaBench JBB direct-request panel · PHARE · RefusalBench · S-Eval · SABER · SafeDialBench · SafetyBench · SafetyPrompts · SALAD-Bench · SM-Bench · Social Welfare Function Benchmark · SORRY-Bench · SpeciEval · SuperCLUE Safety · TAC · ToolPrivacyBench · TrustLLM contemporary collapsed application