Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

Helpful Assistant

Benchmarks

Task NameDataset NameSOTA ResultTrend
Helpful Assistant AlignmentHelpful Assistant normalized rewards (test)
Helpfulness Reward (r1)53
60
Three-objective alignmentHelpful Assistant (test)
Helpfulness Score0.74
36
Preference OptimizationHelpful Assistant
Helpfulness Score53
30
Multi-objective alignmentHelpful Assistant (test)
Helpfulness Score0.76
9
Multi-Objective OptimizationHelpful Assistant Harmless-helpful
MPD1.015
4
Multi-Objective OptimizationHelpful Assistant Humor-helpful
MPD1.439
4
Showing 6 of 6 rows