Peringkat Pemrograman
Lihat model AI mana yang paling baik di Pemrograman, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Metrik ↑.
Model yang ditampilkan
15
Rata-rata Skor Pemrograman
6.1
Model terbaik
Gemini 3.1 Flash Lite Preview 0.0
292/292
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemrograman | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #245 | MiniMax M2.7 medium | Minimax | 5.7 | 5.0 | $0.208 | 1/3 | 101.9s |
| #107 | Kimi K2.6 medium | Moonshot AI | 5.7 | 7.2 | $1.247 | 1/3 | 214.4s |
| #116 | Solar Pro 4 high | Upstage | 5.7 | 7.1 | $0.046 | 1/3 | 244.7s |
| #68 | Claude Sonnet 4.6 medium | Anthropic | 5.7 | 7.8 | $2.126 | 1/3 | 33.3s |
| #75 | Claude Opus 4.6 medium | Anthropic | 5.7 | 7.7 | $2.961 | 1/3 | 30.1s |
| #98 | Gemini 3 Flash Preview low | 5.8 | 7.4 | $0.185 | 1/3 | 6.00s | |
| #80 | Solar Pro 4 xhigh | Upstage | 5.8 | 7.6 | $0.050 | 1/3 | 292.2s |
| #160 | Dots 3 Note Preview high | Dots Studio | 5.8 | 6.4 | $0.000 | 1/3 | 306.2s |
| #148 | Qwen3.5-27B none | Qwen | 5.8 | 6.6 | $0.058 | 1/3 | 1.80s |
| #172 | Qwen3.5-35B-A3B medium | Qwen | 5.9 | 6.1 | $1.140 | 1/3 | 206.6s |
| #159 | Dots 3 Note Preview low | Dots Studio | 5.9 | 6.4 | $0.000 | 1/3 | 287.6s |
| #82 | Claude Opus 5 none | Anthropic | 5.9 | 7.5 | $1.550 | 1/3 | 5.54s |
| #96 | Qwen3.8 2.4T A95B high | Qwen | 5.9 | 7.4 | $2.357 | 1/3 | 160.5s |
| #117 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 41.2s |
| #173 | gpt-oss-120b medium | OpenAI | 5.9 | 6.1 | $0.020 | 1/3 | 38.4s |