Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

FineTasks

Benchmarks

Task NameDataset NameSOTA ResultTrend
Multi-task Language EvaluationFineTasks average across languages
Average Rank4.35
7
Aggregate Benchmark EvaluationFineTasks Turkish (test)
Score0.204
5
Aggregate Benchmark EvaluationFineTasks Arabic (test)
Score0.161
5
Multilingual Language Model EvaluationFineTasks French (test)
Average Rank1.8333
4
Aggregate Benchmark EvaluationFineTasks Hindi (test)
Score8.9
4
Showing 5 of 5 rows