Skip to main content
Benchmark Registry
Models
Benchmarks
Organizations
Search the registry
Search
SWE-bench
Benchmark
SWE-bench
Evaluated by
Princeton University
Release date
May 6, 2025
Version
SWE-bench Multilingual
Metric
Resolved Tasks
Search models
Search
Results
2 results
Rows per page
50
100
500
Apply
Latest
History
All providers
Alibaba (Tongyi)
Anthropic
Cursor
DeepSeek AI
MiniMax
Mistral AI
Moonshot AI
NVIDIA
Z.ai
SWE-bench Multilingual results
Provider
Model
Score
Source
Registry No.
Z.ai
GLM-5
(thinking)
73.3%
Source
for GLM-5 (thinking) on SWE-bench Multilingual
(opens in a new tab)
150002
Z.ai
GLM-4.7
66.7%
Source
for GLM-4.7 on SWE-bench Multilingual
(opens in a new tab)
150001
Previous
Page
1
of
1
Next