Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Long-context language understanding on LongBench En
Loading...
38.84
Single-Document Score
Original Prompt
9.5952
17.1876
24.78
32.3724
May 29, 2025
Single-Document Score
Multi-Document Score
Summarization Score
English Average Score
Overall Average Score
Updated 1mo ago
Evaluation Results
Method
Method
Links
Single-Document Score
Multi-Document Score
Summarization Score
English Average Score
Overall Average Score
Original Prompt
Downstream LLM=Qwen2.5...
2025.05
38.84
44.74
22.76
35.45
37.3
Sentinel
Proxy Model=Qwen2.5-0....
2025.05
37.73
46.16
23.03
35.64
38.02
Raw Attention
Proxy Model=Qwen2.5-0....
2025.05
34.92
38.96
21.32
31.74
33.12
Random
Context Constraint=2K,...
2025.05
28.22
30.68
20.33
26.41
28.3
Empty
Context Constraint=2K,...
2025.05
10.72
22.26
16.46
16.48
16.05
Feedback
Search any
task
Search any
task