Skip to main content
Benchmark Registry
ModelsBenchmarksOrganizations

SWE-bench

Benchmark
SWE-bench
Evaluated by
Princeton University
Release date
May 6, 2025
Version
SWE-bench Multilingual
Metric
Resolved Tasks

Results

4 results

LatestHistory
All providersAlibaba (Tongyi)AnthropicCursorDeepSeek AIMiniMaxMistral AIMoonshot AINVIDIAZ.ai
SWE-bench Multilingual results
ProviderModelScoreSourceRegistry No.
CursorComposer 2.579.8%Source for Composer 2.5 on SWE-bench Multilingual (opens in a new tab)50004
CursorComposer 156.9%Source for Composer 1 on SWE-bench Multilingual (opens in a new tab)50001
CursorComposer 1.565.9%Source for Composer 1.5 on SWE-bench Multilingual (opens in a new tab)50002
CursorComposer 273.7%Source for Composer 2 on SWE-bench Multilingual (opens in a new tab)50003
Page 1 of 1

© 2026 Densa Labs

Toggle between the data update date and the application build time.
Legal
Color theme