Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Agentic Capability on API-Bank, BFCL, and Seal-0 Average
Loading...
70.64
Average Accuracy
Qwen3.6-Plus
60.1256
62.8553
65.585
68.3147
Jun 26, 2026
Average Accuracy
Updated 27d ago
Evaluation Results
Method
Method
Links
Average Accuracy
Qwen3.6-Plus
Model Series=3.6-Plus
2026.06
70.64
Qwen3.5-Plus
Model Series=3.5-Plus
2026.06
68.47
Qwen3-Max
Model Scale=Max
2026.06
66.09
Yuvion-32B
Model Size=32B
2026.06
65.72
GLM-5
Version=5
2026.06
64.06
Kimi-K2.5
Version=K2.5
2026.06
63.97
Qwen3-32B
Model Size=32B
2026.06
60.97
DeepSeek-V3.2
Version=V3.2
2026.06
60.53
Feedback
Search any
task
Search any
task