Peringkat Pemrograman
Lihat model AI mana yang paling baik di Pemrograman, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Metrik ↑.
Model yang ditampilkan
15
Rata-rata Skor Pemrograman
6.1
Model terbaik
Gemini 3.1 Flash Lite Preview 0.0
292/292
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemrograman | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #119 | DeepSeek V3.2 medium | DeepSeek | 6.0 | 7.0 | $0.074 | 1/3 | 248.7s |
| #113 | Qwen3.5-122B-A10B medium | Qwen | 6.0 | 7.1 | $1.047 | 1/3 | 114.5s |
| #144 | GLM 5V Turbo medium | Z.ai | 6.0 | 6.7 | $0.457 | 1/3 | 63.4s |
| #165 | Mimo V2 PRO medium | Xiaomi | 6.0 | 6.3 | $0.333 | 1/3 | 94.2s |
| #166 | MiMo-V2-Flash medium | Xiaomi | 6.0 | 6.3 | $0.043 | 1/3 | 10.7s |
| #64 | Qwen3.6 Plus medium | Qwen | 6.1 | 7.8 | $0.418 | 1/3 | 153.1s |
| #85 | MiniMax M3 medium | Minimax | 6.1 | 7.5 | $0.300 | 1/3 | 144.7s |
| #125 | Kimi K2.5 medium | Moonshot AI | 6.1 | 7.0 | $0.639 | 1/3 | 217.5s |
| #83 | GPT-5.4 Nano medium | OpenAI | 6.1 | 7.5 | $0.142 | 1/3 | 19.1s |
| #141 | KAT-Coder-Pro V2.5 none | Kwaipilot | 6.1 | 6.7 | $0.487 | 1/3 | 22.5s |
| #63 | Qwen3.7 Plus medium | Qwen | 6.1 | 7.9 | $0.277 | 1/3 | 108.6s |
| #67 | GPT-5.6 Terra medium | OpenAI | 6.1 | 7.8 | $0.523 | 1/3 | 7.19s |
| #88 | Qwen3.5-27B medium | Qwen | 6.2 | 7.5 | $0.982 | 1/3 | 160.7s |
| #128 | Seed-2.0-Code high | Bytedance Seed | 6.2 | 6.9 | $1.273 | 1/3 | 266.7s |
| #162 | MiMo-V2.5 medium | Xiaomi | 6.2 | 6.4 | $0.104 | 1/3 | 97.1s |