Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

MMBench

Benchmarks

Task NameDataset NameSOTA ResultTrend
Multimodal UnderstandingMMBench
Accuracy90.6
887
Multimodal UnderstandingMMBench CN
Accuracy88.5
302
Multimodal Model EvaluationMMBench
Accuracy87.8
265
Multimodal ReasoningMMBench
Accuracy90.63
180
Visual Question AnsweringMMBench (MMB)
Accuracy92.1
169
Multimodal BenchmarkingMMBench
Accuracy87.27
168
Multimodal UnderstandingMMBench (MMB)
Accuracy86.3
166
Multimodal EvaluationMMBench CN
Accuracy82.8
163
Multimodal Model EvaluationMMBench Chinese
Accuracy82.6
154
Multimodal BenchmarkingMMBench-CN
Score92.39
151
Multimodal EvaluationMMBench
MMB^CN Score86
146
Vision UnderstandingMMBench
Accuracy85
141
Multimodal UnderstandingMMBench
Accuracy90.1
137
Multimodal ReasoningMMBench EN V1.1
Accuracy80.68
125
Multimodal BenchmarkingMMBench English
Accuracy70.4
125
Multimodal ReasoningMMBench CN
Accuracy82
119
Multi-modal UnderstandingMMBench EN
Accuracy93.53
113
Multimodal BenchmarkMMBench (MMB)
Accuracy81.8
111
Visual Question AnsweringMMBench-CN
Accuracy93.13
99
Multimodal UnderstandingMMBench Chinese
MMB Benchmark (CN)89.5
96
Vision-Language UnderstandingMMBench
Accuracy88.7
88
GUI GroundingMMBench-GUI L2 (test)
Average Error2.9
87
Multi-modal Question AnsweringMMBench
Accuracy86.4
84
Multimodal UnderstandingMMBench English
Accuracy88.79
81
Multi-modal UnderstandingMMBench
Mean Accuracy86.3
79
Showing 25 of 218 rows
...