Skip to main content
Benchmark Registry
ModelsBenchmarksOrganizationsCompare

Terminal-Bench

Benchmark
Terminal-Bench
Evaluated by
Terminal-Bench Team
Release date
November 7, 2025
Version
Terminal-Bench 2.0
Metric
Terminal-Bench Accuracy

Results

4 results

LatestHistory
All providersAnthropicCursorDeepSeek AIGoogle (DeepMind)Meta AI (originally Facebook AI Research)Microsoft AIMiniMaxMistral AIMoonshot AINVIDIAOpenAIZ.ai
Terminal-Bench 2.0 results
ProviderModelScoreSourceRegistry No.
CursorComposer 2.569.3%Source for Composer 2.5 on Terminal-Bench 2.0 (opens in a new tab)50004
CursorComposer 140.0%Source for Composer 1 on Terminal-Bench 2.0 (opens in a new tab)50001
CursorComposer 1.547.9%Source for Composer 1.5 on Terminal-Bench 2.0 (opens in a new tab)50002
CursorComposer 261.7%Source for Composer 2 on Terminal-Bench 2.0 (opens in a new tab)50003
Page 1 of 1

© 2026 Densa Labs

Toggle between the data update date and the application build time.
Legal
Color theme