Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Vision-Language Modeling on WeMath
Loading...
82.6
Accuracy
ZPPO
53.272
60.886
68.5
76.114
Jun 16, 2026
Accuracy
Updated 1mo ago
Evaluation Results
Method
Method
Links
Accuracy
ZPPO
Model Scale=2B, Prompt...
2026.06
82.6
GRPO
Model Scale=2B, Prompt...
2026.06
80.7
On-Distill
Model Scale=2B, Prompt...
2026.06
80.6
GRPO
Model Scale=2B, Prompt...
2026.06
80.4
Off-Distill
Model Scale=2B, Prompt...
2026.06
79.5
Off-Distill
Model Scale=2B, Prompt...
2026.06
79.3
On-Distill
Model Scale=2B, Prompt...
2026.06
79.3
Qwen3.5
Model Scale=2B, Prompt...
2026.06
77.9
ZPPO
Model Scale=0.8B, Prom...
2026.06
71.7
GRPO
Model Scale=0.8B, Prom...
2026.06
62.5
GRPO
Model Scale=0.8B, Prom...
2026.06
60.6
On-Distill
Model Scale=0.8B, Prom...
2026.06
58.6
On-Distill
Model Scale=0.8B, Prom...
2026.06
57.7
Off-Distill
Model Scale=0.8B, Prom...
2026.06
56.4
Off-Distill
Model Scale=0.8B, Prom...
2026.06
55.9
Qwen3.5
Model Scale=0.8B, Prom...
2026.06
54.4
Feedback
Search any
task
Search any
task