Skip to main content
Benchmark Registry
Models
Benchmarks
Organizations
Search the registry
Search
SWE-bench
Benchmark
SWE-bench
Evaluated by
Princeton University
Release date
May 6, 2025
Version
SWE-bench Multilingual
Metric
Resolved Tasks
Search models
Search
Results
5 results
Rows per page
50
100
500
Apply
Latest
History
All providers
Alibaba (Tongyi)
Anthropic
Cursor
DeepSeek AI
MiniMax
Mistral AI
Moonshot AI
NVIDIA
Z.ai
SWE-bench Multilingual results
Provider
Model
Score
Source
Registry No.
Alibaba (Tongyi)
Qwen3.7-Plus
75.8%
Source
for Qwen3.7-Plus on SWE-bench Multilingual
(opens in a new tab)
130007
Alibaba (Tongyi)
Qwen3.7-Max
78.3%
Source
for Qwen3.7-Max on SWE-bench Multilingual
(opens in a new tab)
130006
Alibaba (Tongyi)
Qwen3.6-35B-A3B
67.2%
Source
for Qwen3.6-35B-A3B on SWE-bench Multilingual
(opens in a new tab)
130005
Alibaba (Tongyi)
Qwen3.6-Plus
73.8%
Source
for Qwen3.6-Plus on SWE-bench Multilingual
(opens in a new tab)
130004
Alibaba (Tongyi)
Qwen3.5-397B-A17B
69.3%
Source
for Qwen3.5-397B-A17B on SWE-bench Multilingual
(opens in a new tab)
130003
Previous
Page
1
of
1
Next