| Task Name | Dataset Name | SOTA Result | Trend | |
|---|---|---|---|---|
| Visual Question Answering | Unifybench++ | BLEU78.4 | 13 | |
| Dense Multimodal Reasoning | Unifybench++ | GPT Score85.4 | 13 | |
| Multimodal Reasoning | Unifybench++ | BLEU74.6 | 13 | |
| Concept Recognition | Unifybench++ | Weight93.6 | 13 | |
| Pure Image Generation | Unifybench++ | CLIP-I0.833 | 11 | |
| Reasoning-based Image Generation | Unifybench++ | CLIP-T Score0.376 | 10 |