Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Long-context QA on LongBench Long v2
Loading...
41.7
Accuracy
Qwen3-Coder-30B
20.484
25.992
31.5
37.008
Jun 15, 2026
Accuracy
Updated 1mo ago
Evaluation Results
Method
Method
Links
Accuracy
Qwen3-Coder-30B
Training Source=Off-th...
2026.06
41.7
Qwen3-32B
Training Source=Off-th...
2026.06
31.5
CONTEXTRL
Training Source=Qwen3-...
2026.06
29.6
CONTEXTRL
Training Source=Klear-...
2026.06
28.7
Base model
Training Source=Qwen3-...
2026.06
27.8
RL baseline
Training Source=Qwen3-...
2026.06
26.9
Qwen3-14B
Training Source=Off-th...
2026.06
24.1
RL baseline
Training Source=Klear-...
2026.06
24.1
Base model
Training Source=Klear-...
2026.06
21.3
Feedback
Search any
task
Search any
task