| Task Name | Dataset Name | SOTA Result | Trend | |
|---|---|---|---|---|
| Text-to-Image Generation | GenEval | Overall Score98 | 914 | |
| Text-to-image generation | GenEval | Overall Score96 | 581 | |
| Text-to-Image Generation | GenEval | GenEval Score97.58 | 459 | |
| Text-to-Image Generation | GenEval | Overall Score80.48 | 318 | |
| Text-to-Image Generation | GenEval (test) | Two Obj. Acc99 | 250 | |
| Text-to-Image Generation | GenEval | Overall Score94 | 218 | |
| Text-to-Image Generation | GenEval | Overall Score (GenEval)0.98 | 153 | |
| Image Generation | GenEval | Overall GenEval Score95 | 132 | |
| Text-to-Image Generation | GenEval 1.0 (test) | Overall Score95 | 130 | |
| Text-to-Image Generation | GenEval | GenEval Score0.96 | 108 | |
| Text-to-Image Generation | GenEval | Overall Score88.3 | 96 | |
| Compositional Image Generation | GenEval | Overall Score60.8 | 94 | |
| Text-to-Image Generation | GenEval++ | Color Accuracy90 | 75 | |
| Image Generation | GenEval | Overall Score89 | 69 | |
| Text-to-Image Generation | GenEval 2 | Soft TIFA GM92.6 | 62 | |
| Image Generation | GenEval (test) | GenEval Score91 | 52 | |
| Text-to-Image Generation | GenEval2 In-Domain | GenEval2 Score92.6 | 50 | |
| Visual Generation | GenEval | Two Obj. Acc94 | 43 | |
| Text-to-Image Generation | GenEval (val) | GenEval Score90 | 33 | |
| Text-to-image reward alignment | GenEval (test) | Reward 1 Score (r1)0.26 | 30 | |
| Image Generation | GenEval overall | GenEval Overall Score90 | 30 | |
| Text-to-Image Generation | GenEval | Two Objects Score96.97 | 27 | |
| Text-to-Image Generation | GenEval 1024x1024 | Overall Score (GenEval)0.8 | 23 | |
| Text-to-image generation | GenEval | GenEval Score90 | 21 | |
| Multimodal Generation | GenEval | Score90 | 21 |