Kategori AI BENCHY
Peringkat Pemrograman
Lihat model AI mana yang paling baik di Pemrograman, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Tes benar ↓.
| Peringkat | Model | Perusahaan | Skor Pemrograman | Skor | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|
| #153 | Granite 4.1 8B none | IBM Granite | 5.2 | 4.1 | 0/2 | 706ms |