Skip to main content
Benchmark Registry
Models
Benchmarks
Organizations
Search the registry
Search
SWE-bench
Benchmark
SWE-bench
Evaluated by
OpenAI, Princeton University
Release date
August 13, 2024
Version
SWE-bench Verified
Metric
Resolved Tasks
Search models
Search
Results
1 result
Rows per page
50
100
500
Apply
Latest
History
All providers
Alibaba (Tongyi)
Anthropic
DeepSeek AI
Google (DeepMind)
Meta AI (originally Facebook AI Research)
Microsoft AI
MiniMax
Mistral AI
Moonshot AI
NVIDIA
OpenAI
Z.ai
SWE-bench Verified results
Provider
Model
Score
Source
Registry No.
Microsoft AI
MAI-Thinking-1
73.5%
Source
for MAI-Thinking-1 on SWE-bench Verified
(opens in a new tab)
70003
Previous
Page
1
of
1
Next