Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

Iris

Benchmarks

Task NameDataset NameSOTA ResultTrend
Robustness VerificationIris dataset (test)
Vulnerable Samples0
90
Robustness verificationIris
Vulnerable Samples Count0
50
Robustness VerificationIris Sigmoid Network
Vulnerable Samples0
50
ClassificationIris LDLSS
Accuracy97.33
46
Image DenoisingIRIS Subject2
SSIM88
45
ClusteringIris
ARI0.9
36
Counterfactual Explanation GenerationIris
L2 Distance1.5
30
Online Class-Incremental LearningIris
Final Mean Accuracy97.3
26
ClusteringIris
SSE95.87
24
ClassificationIris (test)
Accuracy100
24
Open-ended Generative VQAIRIS-120K Generative Overall
Generation Average Score36.14
21
Open-ended Generative VQAIRIS-120K Scene-VQA
BLEU-144.23
21
Visual Question AnsweringIRIS 120K (Multi split)
Accuracy88.96
21
Visual Question AnsweringIRIS-120K (Single split)
Accuracy98.52
21
Visual Question AnsweringIRIS-120K (Judge)
Accuracy97.25
21
Counterfactual Explanation Generationiris
Validity100
20
Hierarchical Agglomerative Clusteringiris
Dendrogram Purity94.3
20
ClassificationIris
Accuracy100
19
Tabular ClassificationIris (test)
Accuracy100
18
Multiclass Classificationiris
Accuracy97.33
18
Feature AttributionIRIS
INFD0.007
17
ClusteringIris (UCI)
ARI0.9038
16
Continual ClusteringIris
AI NMI0.871
16
ClusteringIris
AMI0.845
15
Pairwise-constrained clusteringIris UCI (full)
SSE83.72
15
Showing 25 of 110 rows