Skip to main content
Benchmark Registry
ModelsBenchmarksOrganizationsCompare

MMLU-Pro

Benchmark
MMLU-Pro
Evaluated by
Qwen Team
Release date
June 3, 2024
Version
MMLU-Pro Original
Metric
Accuracy

Results

6 results

LatestHistory
All providersAlibaba (Tongyi)DeepSeek AIGoogle (DeepMind)Microsoft AIMistral AIMoonshot AINVIDIAZ.ai
MMLU-Pro Original results
ProviderModelScoreSourceRegistry No.
Alibaba (Tongyi)Qwen3.7-Plus88.5%Source for Qwen3.7-Plus on MMLU-Pro Original (opens in a new tab)130007
Alibaba (Tongyi)Qwen3.7-Max89.6%Source for Qwen3.7-Max on MMLU-Pro Original (opens in a new tab)130006
Alibaba (Tongyi)Qwen3.6-35B-A3B85.2%Source for Qwen3.6-35B-A3B on MMLU-Pro Original (opens in a new tab)130005
Alibaba (Tongyi)Qwen3.6-Plus88.5%Source for Qwen3.6-Plus on MMLU-Pro Original (opens in a new tab)130004
Alibaba (Tongyi)Qwen3.5-397B-A17B87.8%Source for Qwen3.5-397B-A17B on MMLU-Pro Original (opens in a new tab)130003
Alibaba (Tongyi)Qwen3-Max-Thinking85.7%Source for Qwen3-Max-Thinking on MMLU-Pro Original (opens in a new tab)130002
Page 1 of 1

© 2026 Densa Labs

Toggle between the data update date and the application build time.
Legal
Color theme