Skip to main content
Benchmark Registry
ModelsBenchmarksOrganizations

SciCode

Benchmark
SciCode
Evaluated by
Google DeepMind
Release date
July 18, 2024
Version
SciCode Original
Metric
Accuracy

Results

5 results

LatestHistory
All providersAlibaba (Tongyi)Google (DeepMind)Moonshot AI
SciCode Original results
ProviderModelScoreSourceRegistry No.
Google (DeepMind)Gemma 4 26B A4B Instruct (thinking mode)40.0%Source for Gemma 4 26B A4B Instruct (thinking mode) on SciCode Original (opens in a new tab)35001
Google (DeepMind)Gemma 4 31B Instruct (thinking mode)43.0%Source for Gemma 4 31B Instruct (thinking mode) on SciCode Original (opens in a new tab)35002
Google (DeepMind)Gemma 4 E2B Instruct (thinking mode)21.0%Source for Gemma 4 E2B Instruct (thinking mode) on SciCode Original (opens in a new tab)35003
Google (DeepMind)Gemma 4 E4B Instruct (thinking mode)24.0%Source for Gemma 4 E4B Instruct (thinking mode) on SciCode Original (opens in a new tab)35004
Google (DeepMind)Gemma 4 12B Instruct (thinking mode)38.0%Source for Gemma 4 12B Instruct (thinking mode) on SciCode Original (opens in a new tab)35005
Page 1 of 1

© 2026 Densa Labs

Toggle between the data update date and the application build time.
Legal
Color theme