Skip to main content
Benchmark Registry
Models
Benchmarks
Organizations
Search the registry
Search
SWE-bench
Benchmark
SWE-bench
Evaluated by
OpenAI, Princeton University
Release date
August 13, 2024
Version
SWE-bench Verified
Metric
Resolved Tasks
Search models
Search
Results
2 results
Rows per page
50
100
500
Apply
Latest
History
All providers
Alibaba (Tongyi)
Anthropic
DeepSeek AI
Google (DeepMind)
Meta AI (originally Facebook AI Research)
Microsoft AI
MiniMax
Mistral AI
Moonshot AI
NVIDIA
OpenAI
Z.ai
SWE-bench Verified results
Provider
Model
Score
Source
Registry No.
MiniMax
MiniMax M3
80.5%
Source
for MiniMax M3 on SWE-bench Verified
(opens in a new tab)
140003
MiniMax
MiniMax M2.5
80.2%
Source
for MiniMax M2.5 on SWE-bench Verified
(opens in a new tab)
140001
Previous
Page
1
of
1
Next