Skip to main content
Benchmark Registry
Models
Benchmarks
Organizations
Search the registry
Search
SWE-bench
Benchmark
SWE-bench
Evaluated by
OpenAI, Princeton University
Release date
August 13, 2024
Version
SWE-bench Verified
Metric
Resolved Tasks
Search models
Search
Results
1 result
Rows per page
50
100
500
Apply
Latest
History
All providers
Alibaba (Tongyi)
Anthropic
DeepSeek AI
Google (DeepMind)
Meta AI (originally Facebook AI Research)
Microsoft AI
MiniMax
Mistral AI
Moonshot AI
NVIDIA
OpenAI
Z.ai
SWE-bench Verified results
Provider
Model
Score
Source
Registry No.
Meta AI (originally Facebook AI Research)
Muse Glimmer 30B
(high)
76.0%
Source
for Muse Glimmer 30B (high) on SWE-bench Verified
(opens in a new tab)
80004
Previous
Page
1
of
1
Next