Peringkat Pemrograman
Lihat model AI mana yang paling baik di Pemrograman, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Waktu respons (rata-rata) ↑.
292/292
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemrograman | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #97 | Grok 4.6 low | X AI | 5.5 | 7.4 | $0.449 | 1/3 | 21.7s |
| #244 | North Mini Code none | Cohere | 3.9 | 5.1 | $0.000 | 0/3 | 22.0s |
| #108 | KAT-Coder-Pro V2.5 high | Kwaipilot | 6.4 | 7.2 | $0.506 | 1/3 | 22.0s |
| #31 | Muse Spark 1.2 high | Meta | 10.0 | 8.7 | $1.771 | 3/3 | 22.2s |
| #141 | KAT-Coder-Pro V2.5 none | Kwaipilot | 6.1 | 6.7 | $0.487 | 1/3 | 22.5s |
| #42 | GPT-5.2 medium | OpenAI | 10.0 | 8.4 | $1.182 | 3/3 | 22.7s |
| #53 | Muse Spark 1.1 high | Meta | 10.0 | 8.0 | $1.709 | 3/3 | 22.9s |
| #6 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 3/3 | 23.0s | |
| #215 | KAT-Coder-Air V2.5 medium | Kwaipilot | 3.6 | 5.6 | $0.048 | 0/3 | 23.4s |
| #261 | Grok 4.1 Fast medium | X AI | 7.8 | 4.7 | $0.069 | 0/1 | 23.6s |
| #226 | Kimi K2.5 none | Moonshot AI | 5.5 | 5.4 | $0.134 | 1/3 | 24.6s |
| #101 | KAT-Coder-Pro V2.5 low | Kwaipilot | 7.8 | 7.3 | $0.400 | 2/3 | 24.9s |
| #57 | Inkling medium | Thinkingmachines | 8.4 | 8.0 | $0.377 | 2/3 | 25.2s |
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 3/3 | 26.3s | |
| #81 | Nemotron 3 Ultra medium | NVIDIA | 8.4 | 7.6 | $0.780 | 2/3 | 26.5s |