Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Code Generation on HumanEval (HE)
Loading...
48.7
HumanEval Score
95% (CodeEnhance-gemma-4b+CodeQA) + 5% Raw
32.268
36.534
40.8
45.066
Jun 8, 2026
HumanEval Score
Updated 1mo ago
Evaluation Results
Method
Method
Links
HumanEval Score
95% (CodeEnhance-gemma-4b+CodeQA) + 5% Raw
Tokens (B)=10
2026.06
48.7
Nemotron-RW
Tokens (B)=10
2026.06
48.2
80% CodeEnhance-gemma-4b + 15% CodeQA + 5% Raw
Tokens (B)=10
2026.06
46.3
90% (CodeEnhance-gemma-4b+CodeQA) + 10% Raw
Tokens (B)=10
2026.06
45.7
50% CodeEnhance + 50% Nemotron-RW
Tokens (B)=10
2026.06
45.7
CodeEnhance+Nemotron-RW+SwallowCode
Tokens (B)=10
2026.06
45.1
CodeEnhance+CodeQA
Tokens (B)=10
2026.06
45.1
SwallowCode
Tokens (B)=10
2026.06
43.9
85% CodeEnhance-gemma-4b + 10% CodeQA + 5% Raw
Tokens (B)=10
2026.06
43.3
75% CodeEnhance-gemma-4b + 15% CodeQA + 10% Raw
Tokens (B)=10
2026.06
43.3
95% CodeEnhance+CodeQA + 5% Raw
Tokens (B)=10
2026.06
42.7
95% Nemotron-RW + 5% Raw
Tokens (B)=10
2026.06
41.5
CodeEnhance-gemma-4b
Tokens (B)=10
2026.06
38.4
90% CodeEnhance+CodeQA + 10% Raw
Tokens (B)=10
2026.06
37.8
95% SwallowCode + 5% Raw
Tokens (B)=10
2026.06
37.2
CodeEnhance
Tokens (B)=10
2026.06
34.1
CodeEnhance-gemma-1b
Tokens (B)=10
2026.06
32.9
Feedback
Search any
task
Search any
task