Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

CC3M

Benchmarks

Task NameDataset NameSOTA ResultTrend
Image GenerationCC3M SDXL v1.0 (test)
FID33.49
27
Aesthetic EvaluationCC3M SDXL 1.0 (test)
HPS0.2932
27
Object RecognitionCC3M (test)
Recall0.738
21
Aesthetic EvaluationCC3M
HPS0.2757
15
Image GenerationCC3M (test)
FID36.96
15
Multimodal UnderstandingCC3M IOD
Accuracy100
14
Malicious Prompt DetectionCC3M (IOD)
FPR0
14
Text-to-Image RetrievalCC3M
Recall45.7
9
Image-to-Text RetrievalCC3M
Recall47.2
9
Image ClassificationCC3M
Accuracy46.7
9
Multi-Tag SelectionCC3M (test)
Precision92.5
9
Text-to-image generationCC3M
FID6.06
7
Image-Text RetrievalCC3M-595K-LLaVA 1
IR Score7.6
6
Conditional InversionCC3M first 500 images
PSNR25.24
6
Unconditional InversionCC3M first 500 images
PSNR24.41
6
Multi-Tag SelectionCC3M
Precision0.883
6
Backdoor Defense (Multimodal)CC3M 60K subset 1.0 (test)
Clean Accuracy (CA)64.03
5
Vision-Language Compositional EvaluationCC3M 50,000 random subset TripletData
Text Score92.25
4
Text-level Semantic SegmentationCC3M (subset)
Caption IoU65.5
4
Object RecognitionCC3M
Recall86.8
3
Showing 20 of 20 rows