Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Long-context QA on LongBench Overall v2
Loading...
42.5
Accuracy
Qwen3-Coder-30B
26.38
30.565
34.75
38.935
Jun 15, 2026
Accuracy
Updated 1mo ago
Evaluation Results
Method
Method
Links
Accuracy
Qwen3-Coder-30B
Training Source=Off-th...
2026.06
42.5
Qwen3-32B
Training Source=Off-th...
2026.06
36.8
Qwen3-14B
Training Source=Off-th...
2026.06
34.2
CONTEXTRL
Training Source=Qwen3-...
2026.06
33.2
RL baseline
Training Source=Qwen3-...
2026.06
31.8
Base model
Training Source=Qwen3-...
2026.06
31.6
CONTEXTRL
Training Source=Klear-...
2026.06
29.6
Base model
Training Source=Klear-...
2026.06
27.4
RL baseline
Training Source=Klear-...
2026.06
27
Feedback
Search any
task
Search any
task