Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Multitask Language Understanding on Global MMLU-Lite
Loading...
64.5
Accuracy
BYOL-nya
21.34
32.545
43.75
54.955
Jan 15, 2026
Feb 7, 2026
Mar 2, 2026
Mar 26, 2026
Apr 18, 2026
May 11, 2026
Jun 4, 2026
Accuracy
Updated 1mo ago
Evaluation Results
Method
Method
Links
Accuracy
BYOL-nya
Parameters=12B, Pre-tr...
2026.01
64.5
SDAR
Scale=8B, Inference Mo...
2026.06
60.8
Gemma-3
Parameters=12B, Pre-tr...
2026.01
60.75
OPDLM
Scale=8B, Inference Mo...
2026.06
56
BYOL-nya
Parameters=4B, Pre-tra...
2026.01
55.25
OPDLM
Scale=4B, Inference Mo...
2026.06
51.6
Fast-dLLM-v2
Scale=7B, Inference Mo...
2026.06
51.5
Gemma-3
Parameters=4B, Pre-tra...
2026.01
50.75
SDAR
Scale=4B, Inference Mo...
2026.06
50.7
Qwen-3
Parameters=14B, Pre-tr...
2026.01
45.75
Llama-3.1
Parameters=8B, Pre-tra...
2026.01
43.25
Apertus
Parameters=8B, Pre-tra...
2026.01
41.75
Qwen-3
Parameters=8B, Pre-tra...
2026.01
37.5
Qwen-3
Parameters=1.7B, Pre-t...
2026.01
32.5
Llama-3.2
Parameters=1B, Pre-tra...
2026.01
28.25
Gemma-3
Parameters=1B, Pre-tra...
2026.01
26.75
BYOL-nya
Parameters=1B, Pre-tra...
2026.01
23
Feedback
Search any
task
Search any
task