Peringkat Pemrograman
Lihat model AI mana yang paling baik di Pemrograman, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Tes benar ↓.
292/292
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemrograman | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #226 | Kimi K2.5 none | Moonshot AI | 5.5 | 5.4 | $0.134 | 1/3 | 24.6s |
| #228 | Laguna S 2.1 high | Poolside | 5.3 | 5.4 | $0.114 | 1/3 | 271.4s |
| #234 | Qwen3.6 35B A3B none | Qwen | 5.5 | 5.3 | $0.060 | 1/3 | 8.77s |
| #241 | MiMo-V2.5 none | Xiaomi | 5.5 | 5.1 | $0.025 | 1/3 | 3.24s |
| #245 | MiniMax M2.7 medium | Minimax | 5.7 | 5.0 | $0.208 | 1/3 | 101.9s |
| #250 | Ling-2.6-flash none | Inclusionai | 5.3 | 4.9 | $0.002 | 1/3 | 11.2s |
| #252 | Ring-2.6-1T none | Inclusionai | 5.3 | 4.8 | $0.026 | 1/3 | 143.8s |
| #120 | GLM 5.1 medium | Z.ai | 4.6 | 7.0 | $0.948 | 0/3 | 109.6s |
| #130 | Qwen3.6 Flash medium | Qwen | 5.0 | 6.8 | $0.741 | 0/3 | 42.9s |
| #131 | Step 3.7 Flash high | Stepfun | 4.0 | 6.8 | $1.229 | 0/3 | 206.2s |
| #139 | Gemma 4 26B A4B medium | 2.9 | 6.8 | $0.092 | 0/3 | 272.5s | |
| #140 | GLM 5.2 none | Z.ai | 3.7 | 6.7 | $0.188 | 0/3 | 7.55s |
| #147 | Gemini 3.5 Flash Lite low | 4.3 | 6.6 | $0.138 | 0/3 | 917ms | |
| #153 | Qwen3.5 Plus 2026-02-15 none | Qwen | 4.3 | 6.6 | $0.073 | 0/3 | 2.05s |
| #158 | Qwen3.6 Max Preview none | Qwen | 3.8 | 6.4 | $0.228 | 0/3 | 3.12s |