Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Long-context Understanding on LongBench (Task Performance Metrics)
Loading...
32.03
Single-Doc QA Score
ET
26.6532
28.0491
29.445
30.8409
May 14, 2026
Single-Doc QA Score
Multi-Doc QA Score
Summarization Score
Few-Shot Learning Score
Synthetic Task Score
Code Completion Score
Average Score
Updated 2mo ago
Evaluation Results
Method
Method
Links
Single-Doc QA Score
Multi-Doc QA Score
Summarization Score
Few-Shot Learning Score
Synthetic Task Score
Code Completion Score
Average Score
ET
Target Context Window=...
2026.05
32.03
30.81
26.04
68.04
4.54
66.48
38.3
Full FT
Target Context Window=...
2026.05
28.86
29.51
24.88
62.81
6.31
47.86
35.63
LCEG
Target Context Window=...
2026.05
27.86
28.51
23.88
61.81
5.31
46.86
36.61
LongLoRA
Target Context Window=...
2026.05
26.86
27.51
22.88
60.81
4.31
45.86
36.84
Feedback
Search any
task
Search any
task