Skip to main content
Benchmark Registry
Models
Benchmarks
Organizations
Compare
Search the registry
Search
SWE-bench
Benchmark
SWE-bench
Evaluated by
OpenAI, Princeton University
Release date
August 13, 2024
Version
SWE-bench Verified
Metric
Resolved Tasks
Search models
Search
Showing the selected evaluation.
Show all results
Results
1 result
Rows per page
50
100
500
Apply
Latest
History
All providers
Anthropic
SWE-bench Verified results
Provider
Model
Score
Source
Registry No.
Anthropic
Claude Fable 5
95.0%
Source
for Claude Fable 5 on SWE-bench Verified
(opens in a new tab)
20012
Previous
Page
1
of
1
Next