Pemrograman: Jawaban salah
Pemrograman
Jawaban salah
Lihat model AI mana yang paling mungkin mengalami Jawaban salah di Pemrograman, agar Anda bisa menemukan titik lemahnya lebih cepat.
Alasan kegagalan
197/197
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Jumlah Jawaban salah | Skor kategori | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #252 | Trinity Large Thinking high | Arcee AI | 1 | 3.7 | $0.624 | 0/3 | 245.0s |
| #254 | KAT-Coder-Air V2.5 none | Kwaipilot | 1 | 3.3 | $0.070 | 0/3 | 14.3s |
| #256 | Trinity Large Preview none | Arcee AI | 1 | 3.7 | $0.008 | 0/3 | 14.3s |
| #260 | Cobuddy medium | Baidu | 1 | 3.7 | $0.000 | 0/3 | 79.2s |
| #263 | MiniMax M2.5 medium | Minimax | 1 | 3.4 | $0.273 | 0/3 | 188.6s |
| #265 | Grok 4.20 Beta none | X AI | 1 | 1.8 | $0.087 | 0/1 | 1.14s |
| #266 | Laguna M.1 none | Poolside | 1 | 2.5 | $0.009 | 0/1 | 2.93s |
| #267 | Elephant Alpha none | Openrouter | 1 | 4.2 | $0.000 | 0/3 | 1.39s |
| #269 | Elephant Alpha medium | Openrouter | 1 | 3.7 | $0.000 | 0/3 | 1.30s |
| #271 | Grok 4.20 none | X AI | 1 | 1.1 | $0.057 | 0/1 | 1.22s |
| #272 | Laguna Xs.2 medium | Poolside | 1 | 2.1 | $0.015 | 0/1 | 14.4s |
| #273 | Hy3 preview none | Tencent | 1 | 2.7 | $0.007 | 0/3 | 4.56s |
| #276 | Granite 4.1 8B none | IBM Granite | 1 | 4.5 | $0.007 | 0/3 | 775ms |
| #281 | Grok 4.1 Fast none | X AI | 1 | 1.8 | $0.008 | 0/1 | 1.79s |
| #284 | Laguna Xs.2 none | Poolside | 1 | 8.3 | $0.004 | 0/1 | 1.96s |