Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

Product

Benchmarks

Task NameDataset NameSOTA ResultTrend
Text ClassificationProduct (test)
F1 Score78.3
22
Header PredictionProduct (test)
Accuracy99.97
16
FraudProduct
ASR100
15
Row ClassificationProduct (test)
Macro-F1 (XGBoost)94.4
11
Image RetrievalProduct-M
AR@179.36
10
Personalized Image GenerationProduct
Consistency0.3296
9
Sequential RecommendationProduct (test)
Recall@10.0055
8
Link PredictionProduct (test)
P@177.86
8
Value ImputationProduct
Accuracy79.77
7
Header PredictionProduct
Accuracy99.95
7
Personalized Video GenerationProduct
Consistency0.6355
6
Collaborative identifier predictionProduct
Recall@101.26
5
Part-based Image GenerationProduct
FID47.9
5
ClusteringProduct
F1 Score59
2
ClassificationProduct
Validation Accuracy96.83
2
Human-LLM AgreementProduct Total All languages 1.0 (val)
Accuracy95.2
1
Human-LLM AgreementProduct French subset 1.0 (val)
Accuracy94
1
Human-LLM AgreementProduct Spanish subset 1.0 (val)
Accuracy94.7
1
Human-LLM AgreementProduct German 1.0 (val)
Accuracy95.3
1
Human-LLM AgreementProduct Italian 1.0 (val)
Accuracy96.4
1
Showing 20 of 20 rows