Peringkat Pemrograman
Lihat model AI mana yang paling baik di Pemrograman, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Metrik ↑.
Model yang ditampilkan
15
Rata-rata Skor Pemrograman
6.1
Model terbaik
Gemini 3.1 Flash Lite Preview 0.0
292/292
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemrograman | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #79 | GPT-5.6 Luna high | OpenAI | 5.5 | 7.6 | $0.179 | 1/3 | 15.6s |
| #91 | Gemini 3.1 Flash Lite Preview medium | 5.5 | 7.4 | $0.117 | 1/3 | 4.09s | |
| #92 | Qwen3.7 Max none | Qwen | 5.5 | 7.4 | $0.197 | 1/3 | 1.35s |
| #99 | Claude Sonnet 4.6 none | Anthropic | 5.5 | 7.3 | $0.661 | 1/3 | 5.19s |
| #103 | Gemini 3.1 Flash Lite medium | 5.5 | 7.3 | $0.120 | 1/3 | 3.81s | |
| #104 | Qwen3.7 Plus none | Qwen | 5.5 | 7.3 | $0.106 | 1/3 | 2.15s |
| #106 | Claude Opus 4.8 none | Anthropic | 5.5 | 7.3 | $1.166 | 1/3 | 3.29s |
| #118 | GPT-5.6 Sol none | OpenAI | 5.5 | 7.0 | $0.201 | 1/3 | 1.39s |
| #121 | GPT-5.5 none | OpenAI | 5.5 | 7.0 | $0.544 | 1/3 | 1.35s |
| #138 | Gemini 3 Flash Preview none | 5.5 | 6.8 | $0.085 | 1/3 | 1.80s | |
| #149 | Gemini 3.1 Flash Lite Preview low | 5.5 | 6.6 | $0.646 | 1/3 | 1.39s | |
| #151 | Gemini 3.1 Flash Lite low | 5.5 | 6.6 | $0.621 | 1/3 | 1.53s | |
| #155 | Laguna XS 2.1 medium | Poolside | 5.5 | 6.5 | $0.068 | 1/3 | 70.3s |
| #157 | Gemini 3.1 Flash Lite Preview none | 5.5 | 6.4 | $0.052 | 1/3 | 967ms | |
| #161 | LongCat 2.0 none | Meituan | 5.5 | 6.4 | $0.044 | 1/3 | 2.85s |