- Peringkat
- #108
- Total token output
- 144,359
- Waktu respons (rata-rata)
- 22.11s
- Total Biaya
- $0.506
KAT-Coder-Pro V2.5 (high) vs Qwen3.7 Plus
Qwen3.7 Plus unggul dalam skor rata-rata dengan 7.3 vs 7.2. Qwen3.7 Plus memiliki biaya benchmark lebih rendah di $0.106 vs $0.506. Qwen3.7 Plus lebih cepat di 12.11s vs 22.11s, dengan tingkat keberhasilan 63.6% vs 54.6%.
- Peringkat
- #104
- Total token output
- 58,097
- Waktu respons (rata-rata)
- 12.11s
- Total Biaya
- $0.106
Model yang direkomendasikan
Qwen3.7 Plus
It has the best score here (7.3), while costing about 4.8x less than KAT-Coder-Pro V2.5 (high).
Perbandingan terperinci
| Metrik | KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 high | Qwen3.7 Plus Qwen3.7 Plus none |
|---|---|---|
| Skor | 7.2 | 7.3 |
| Peringkat | #108 | #104 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 7.8 | 10.0 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 63.6% | 54.6% |
| Tes tidak stabil | 6 | 0 |
| Total Run | 66 | 66 |
| Biaya per hasil | 4.599 | 0.930 |
| Total Biaya | $0.506 | $0.106 |
| Harga input | $0.740 / 1M | $0.320 / 1M |
| Harga output | $2.960 / 1M | $1.280 / 1M |
| Total token input | 106,085 | 98,833 |
| Token output | 9,071 | 58,097 |
| Token penalaran | 135,288 | 0 |
| Waktu respons (rata-rata) | 22.11s | 12.11s |
| Waktu respons (maks) | 199.97s | 206.03s |
| Waktu respons (total) | 486.31s | 266.40s |
| Parameter | ~700B total (~72B aktif) | ~397B total (~17B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#108 KAT-Coder-Pro V2.5
high- Biaya
- $0.009
- Waktu
- 26.4s
- Token
- 3,117 tok
#104 Qwen3.7 Plus
none- Biaya
- $0.019
- Waktu
- 213.5s
- Token
- 11,960 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 7.0 | 8.0 | 66.7% | 1 | 3.17s | 672 | 447 | 2,716 | |
| Qwen3.7 Plus | 6.5 | 10.0 | 50.0% | 0 | 1.38s | 696 | 349 | 0 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 6.4 | 7.9 | 44.4% | 1 | 22.00s | 7,893 | 422 | 20,461 | |
| Qwen3.7 Plus | 5.5 | 10.0 | 33.3% | 0 | 2.15s | 7,911 | 639 | 0 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 7.3 | 5.8 | 83.3% | 1 | 106.70s | 78,458 | 6,956 | 60,306 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 117.70s | 71,266 | 56,024 | 0 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.13s | 7,776 | 278 | 1,960 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 1.43s | 7,794 | 243 | 0 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 2.9 | 4.4 | 22.2% | 2 | 44.66s | 780 | 33 | 43,896 | |
| Qwen3.7 Plus | 5.3 | 10.0 | 33.3% | 0 | 1.04s | 798 | 18 | 0 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 5.1 | 10.0 | 0.0% | 0 | 3.27s | 516 | 139 | 647 | |
| Qwen3.7 Plus | 5.3 | 10.0 | 0.0% | 0 | 1.33s | 522 | 78 | 0 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 9.9 | 10.0 | 100.0% | 0 | 2.67s | 699 | 84 | 976 | |
| Qwen3.7 Plus | 6.3 | 10.0 | 50.0% | 0 | 929ms | 711 | 72 | 0 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 8.2 | 7.2 | 88.9% | 1 | 3.38s | 696 | 428 | 1,936 | |
| Qwen3.7 Plus | 7.7 | 10.0 | 66.7% | 0 | 1.71s | 714 | 443 | 0 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 10.0 | 10.0 | 100.0% | 0 | 28.04s | 8,391 | 268 | 896 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 3.54s | 8,211 | 222 | 0 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| KAT-Coder-Pro V2.5 | 3.0 | 10.0 | 0.0% | 0 | 5.22s | 204 | 16 | 1,494 | |
| Qwen3.7 Plus | 3.0 | 10.0 | 0.0% | 0 | 1.21s | 210 | 9 | 0 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Gemini 3.1 Flash LitemediumvsQwen3.7 PlusnoneKAT-Coder-Pro V2.5highvsKimi K2.6mediumQwen3.7 PlusnonevsGLM 5.3 FlashhighDeepSeek V4 Flash 0731mediumvsQwen3.7 PlusnoneKAT-Coder-Pro V2.5highvsQwen3.5 Plus 2026-04-20mediumClaude Opus 4.8nonevsKAT-Coder-Pro V2.5highKAT-Coder-Pro V2.5lowvsQwen3.7 PlusnoneQwen3.7 PlusnonevsGLM 5.3highDeepSeek V4 Flash 0731mediumvsKAT-Coder-Pro V2.5highKAT-Coder-Pro V2.5highvsQwen3.7 FlashlowKimi K2.6mediumvsQwen3.7 PlusnoneKAT-Coder-Pro V2.5highvsMuse Glimmer 30Bmedium