Peringkat Pemrograman
Lihat model AI mana yang paling baik di Pemrograman, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Metrik ↑.
Model yang ditampilkan
15
Rata-rata Skor Pemrograman
6.1
Model terbaik
Gemini 3.1 Flash Lite Preview 0.0
292/292
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemrograman | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #213 | Mimo V2 PRO none | Xiaomi | 5.5 | 5.6 | $0.045 | 1/3 | 2.65s |
| #217 | Qwen3.6 27B none | Qwen | 5.5 | 5.5 | $0.083 | 1/3 | 4.16s |
| #219 | Qwen3.8 27B none | Qwen | 5.5 | 5.5 | ~$0.006 | 1/3 | 1.19s |
| #226 | Kimi K2.5 none | Moonshot AI | 5.5 | 5.4 | $0.134 | 1/3 | 24.6s |
| #234 | Qwen3.6 35B A3B none | Qwen | 5.5 | 5.3 | $0.060 | 1/3 | 8.77s |
| #241 | MiMo-V2.5 none | Xiaomi | 5.5 | 5.1 | $0.025 | 1/3 | 3.24s |
| #124 | Seed-2.0-Mini medium | Bytedance Seed | 5.5 | 7.0 | $0.116 | 1/3 | 220.5s |
| #206 | Kimi K2.6 none | Moonshot AI | 5.5 | 5.7 | $0.233 | 1/3 | 82.6s |
| #97 | Grok 4.6 low | X AI | 5.5 | 7.4 | $0.449 | 1/3 | 21.7s |
| #86 | GPT 5.3 Chat none | OpenAI | 5.6 | 7.5 | $0.533 | 1/3 | 10.5s |
| #135 | DeepSeek V4 Pro none | DeepSeek | 5.6 | 6.8 | $0.191 | 1/3 | 13.4s |
| #167 | Seed-2.0-Lite none | Bytedance Seed | 5.6 | 6.2 | $0.066 | 1/3 | 2.83s |
| #143 | Gemini 3.5 Flash minimal | 5.6 | 6.7 | $0.300 | 1/3 | 2.75s | |
| #214 | Owl Alpha none | Openrouter | 5.6 | 5.6 | $0.000 | 1/3 | 36.9s |
| #90 | Grok Build 0.1 medium | X AI | 5.7 | 7.5 | $1.130 | 1/3 | 108.5s |