Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Multimodal Reasoning on LVista
Loading...
73.8
Accuracy
Gemini-2.5-Pro
31.68
42.615
53.55
64.485
Jun 29, 2026
Accuracy
Updated 25d ago
Evaluation Results
Method
Method
Links
Accuracy
Gemini-2.5-Pro
Model Category=Closed-...
2026.06
73.8
GPT-5
Model Category=Closed-...
2026.06
69.3
TACO (Ours-7B)
Model Category=Code-to...
2026.06
55.6
Qwen3-VL-8B
Model Category=Open-so...
2026.06
54.9
Qwen2.5-VL-32B
Model Category=Open-so...
2026.06
54.4
GPT-4o
Model Category=Closed-...
2026.06
53.2
PyVision-RL-7B
Model Category=Code-to...
2026.06
49.2
Thyme-7B
Model Category=Code-to...
2026.06
49
DeepEyes-v2-7B
Model Category=Code-to...
2026.06
48.7
CodeV-RL-7B
Model Category=Code-to...
2026.06
48.7
DeepEyes-7B
Model Category=Code-to...
2026.06
47.7
Pixel-Reasoner-7B
Model Category=Code-to...
2026.06
46.4
Mini-o3-7B
Model Category=Code-to...
2026.06
45.7
InternVL3-8B
Model Category=Open-so...
2026.06
45.6
MathCoder-VL-8B
Model Category=Code-to...
2026.06
41.6
Qwen2.5-VL-7B
Model Category=Open-so...
2026.06
39.8
LLaVA-OneVision-7B
Model Category=Open-so...
2026.06
33.3
Feedback
Search any
task
Search any
task