Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Explanation Faithfulness Evaluation on BiasQA (test)
Loading...
20.7
Greedy
DPO + RM
13.524
15.387
17.25
19.113
Apr 7, 2025
Greedy
Maj@16
Updated 18d ago
Evaluation Results
Method
Method
Links
Greedy
Maj@16
DPO + RM
Base Model=LLAMA-3.2-3...
2025.04
20.7
19.5
DPO + RMC
Base Model=LLAMA-3.2-3...
2025.04
18.2
13.9
DPO + RMD
Base Model=LLAMA-3.2-3...
2025.04
16.5
11.4
DPO + RMD
Base Model=LLAMA-3.2-3...
2025.04
15.3
12.5
Base
Base Model=LLAMA-3.2-3...
2025.04
14.9
17.2
DPO + RM
Base Model=LLAMA-3.2-3...
2025.04
14.1
12.4
DPO + RMC
Base Model=LLAMA-3.2-3...
2025.04
13.8
10.8
Feedback
Search any
task
Search any
task