Leaderboard
EvalPlus
evalplusRecord
- Category
- coding
- Scored models
- 9
Scores
| Model | Score |
|---|---|
| JetBrains/Mellum2-12B-A2.5B-Instruct | 76.2 |
| tencent/Hunyuan-A13B-Instruct | 75.69 |
| Qwen/Qwen2-72B | 75.2 |
| Qwen/Qwen2-7B | 60.9 |
| Qwen/Qwen2-72B | 55 |
| Qwen/Qwen2-57B-A14B | 48.5 |
| Qwen/Qwen2-57B-A14B | 46.4 |
| tencent/Hunyuan-7B-Pretrain | 39.71 |
| Qwen/Qwen2-7B | 36.4 |
Remaining fields
Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.
- category
- coding
- id
- evalplus
- name
- EvalPlus
- schema version
- local-ai-registry/v1
rows
| variant | conf | context | model id | org | rank | root | score |
|---|---|---|---|---|---|---|---|
| Mellum2-12B-A2.5B-Instruct-GGUF | medium | EvalPlus | mellum2-12b-a2-5b-instruct | Mungert | 1 | JetBrains/Mellum2-12B-A2.5B-Instruct | 76.2 |
| Hunyuan-A13B-Instruct-GGUF | medium | EvalPlus | hunyuan-a13b-instruct | unsloth | 2 | tencent/Hunyuan-A13B-Instruct | 75.69 |
| Qwen2-72B-Instruct | medium | EvalPlus | qwen2-72b | Qwen | 3 | Qwen/Qwen2-72B | 75.2 |
| Qwen2-7B-Instruct | medium | Evalplus | qwen2-7b | Qwen | 4 | Qwen/Qwen2-7B | 60.9 |
| Qwen2-72B | medium | EvalPlus | qwen2-72b | Qwen | 5 | Qwen/Qwen2-72B | 55 |
| Qwen2-57B-A14B-Instruct | medium | EvalPlus | qwen2-57b-a14b | Qwen | 6 | Qwen/Qwen2-57B-A14B | 48.5 |
| Qwen2-57B-A14B | medium | EvalPlus | qwen2-57b-a14b | Qwen | 7 | Qwen/Qwen2-57B-A14B | 46.4 |
| Hunyuan-7B-Instruct-GGUF | medium | EvalPlus | hunyuan-7b-pretrain | Mungert | 8 | tencent/Hunyuan-7B-Pretrain | 39.71 |
| Qwen2-7B | medium | EvalPlus | qwen2-7b | Qwen | 9 | Qwen/Qwen2-7B | 36.4 |
Provenance & metadata (1)
source
- kind
- leaderboard-scrape
- paths
- benchmarks/evalplus.html