Codesota · Models · GLM-4.5Zhipu AI14 results · 8 benchmarks
Model card

GLM-4.5.

Zhipu AIopen-source
§ 02 · Benchmarks

Every benchmark GLM-4.5 has a recorded score for.

#BenchmarkArea · TaskMetricValueRankDateSource
01SimpleQANatural Language Processing · Question Answeringaccuracy26.4%#4/7source ↗
02LiveCodeBenchComputer Code · Code Generationpass-172.9%#14/24source ↗
03BrowseCompNatural Language Processing · Question Answeringaccuracy26.4%#15/16source ↗
04MMLUReasoning · Commonsense Reasoningaccuracy90.0%#15/64source ↗
05SWE-Bench VerifiedComputer Code · Code Generationaccuracy64.2%#18/22source ↗
06GPQA DiamondReasoning · Multi-step Reasoningaccuracy79.1%#33/74source ↗
07HLEReasoning · Multi-step Reasoningaccuracy14.4%#43/74source ↗
08PLCCNatural Language Processing · Polish Cultural Competencygeography79.0%#61/165source ↗
09PLCCNatural Language Processing · Polish Cultural Competencyhistory77.0%#69/165source ↗
10PLCCNatural Language Processing · Polish Cultural Competencyculture-and-tradition68.0%#70/165source ↗
11PLCCNatural Language Processing · Polish Cultural Competencyvocabulary60.0%#73/165source ↗
12PLCCNatural Language Processing · Polish Cultural Competencyart-and-entertainment56.0%#74/165source ↗
13PLCCNatural Language Processing · Polish Cultural Competencyaverage66.5%#74/165source ↗
14PLCCNatural Language Processing · Polish Cultural Competencygrammar59.0%#82/165source ↗
Rank column shows this model’s position vs all other models scored on the same benchmark + metric (competitors after the slash). #1 in red means current SOTA. Sorted by rank, then newest result.
§ 03 · Strengths by area

Where GLM-4.5 actually performs.

Computer Code
2
benchmarks
avg rank #16.0
Reasoning
3
benchmarks
avg rank #30.3
Natural Language Processing
3
benchmarks
avg rank #58.0
§ 04 · Papers

1 paper with results for GLM-4.5.

  1. 2025-08-08· 7 results

    GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models

§ 05 · Related models

Other Zhipu AI models scored on Codesota.

GLM-5
130B params · 8 results · 1 SOTA
GLM-4.5-Air
5 results
GLM-OCR
3 results
GLM-4.5
2 results
GLM-4.5-Air
2 results
GLM-4.7
2 results
GLM-4.6
1 result
GLM-4.7
1 result
§ 06 · Sources & freshness

Where these numbers come from.

pwc-dump
7
results
sdadas/PLCC
7
results
7 of 14 rows marked verified.