Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Medical Reasoning on Lancet
Loading...
63.3
Accuracy
Embedding Diversity
59.66
60.605
61.55
62.495
Jun 25, 2026
Accuracy
Updated 29d ago
Evaluation Results
Method
Method
Links
Accuracy
Embedding Diversity
Model=Qwen2.5-7B-Instr...
2026.06
63.3
S2L
Model=Qwen2.5-7B-Instr...
2026.06
62.6
Middle Perplexity
Model=Qwen2.5-7B-Instr...
2026.06
61.4
Ours
Model=Qwen2.5-7B-Instr...
2026.06
61.4
Random
Model=Qwen2.5-7B-Instr...
2026.06
61.2
m1k
Model=Qwen2.5-7B-Instr...
2026.06
60.4
Learnability
Model=Qwen2.5-7B-Instr...
2026.06
59.8
Feedback
Search any
task
Search any
task