Peringkat Pemrograman
Lihat model AI mana yang paling baik di Pemrograman, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Total Biaya ↓.
Model yang ditampilkan
15
Rata-rata Skor Pemrograman
6.1
Model terbaik
Grok 4.20 Multi Agent Beta 3.3
292/292
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemrograman | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #43 | Qwen3.8 27B high | Qwen | 8.1 | 8.4 | ~$0.287 | 2/3 | 248.6s |
| #112 | Muse Glimmer 30B medium | Meta | 8.4 | 7.2 | $0.280 | 2/3 | 33.7s |
| #186 | GPT-5.6 Terra none | OpenAI | 5.5 | 6.0 | $0.280 | 1/3 | 1.00s |
| #63 | Qwen3.7 Plus medium | Qwen | 6.1 | 7.9 | $0.277 | 1/3 | 108.6s |
| #66 | GLM 5.2 medium | Z.ai | 8.2 | 7.8 | $0.276 | 2/3 | 41.0s |
| #65 | Gemini 3.5 Flash Lite medium | 7.9 | 7.8 | $0.272 | 2/3 | 9.96s | |
| #136 | GLM 5.3 low | Z.ai | 6.2 | 6.8 | $0.257 | 1/3 | 21.0s |
| #28 | Gemini 3.6 Flash low | 7.8 | 8.7 | $0.251 | 2/3 | 6.95s | |
| #207 | Qwen3.5-122B-A10B none | Qwen | 3.7 | 5.7 | $0.247 | 0/3 | 2.77s |
| #50 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 3/3 | 27.6s |
| #70 | Seed-2.0-Lite medium | Bytedance Seed | 8.0 | 7.8 | $0.236 | 2/3 | 156.7s |
| #206 | Kimi K2.6 none | Moonshot AI | 5.5 | 5.7 | $0.233 | 1/3 | 82.6s |
| #158 | Qwen3.6 Max Preview none | Qwen | 3.8 | 6.4 | $0.228 | 0/3 | 3.12s |
| #73 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 3/3 | 74.3s |
| #137 | MiMo-V2.5-Pro medium | Xiaomi | 6.2 | 6.8 | $0.221 | 1/3 | 92.1s |