AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Eșecuri pe categorii AI BENCHY

Programare: Timp expirat

Programare
Timp expirat

Vezi ce modele AI au cele mai mari șanse să întâmpine Timp expirat la Programare, ca să găsești mai repede punctele slabe.

Modele afișate

12

Eșecuri totale

12

Modelul cel mai afectat

Gemma 4 31B 1
Rang Model Companie Număr de Timp expirat Scor de categorie Teste corecte Timp de răspuns (mediu)
#12 Gemma 4 31B medium Google 1 4.7 0/1 71.0s
#17 Qwen3.5-122B-A10B medium Qwen 1 4.7 0/1 71.0s
#22 Gemma 4 26B A4B medium Google 1 2.8 0/1 147.5s
#25 DeepSeek V3.2 medium DeepSeek 1 4.7 0/1 180.9s
#30 Qwen3.5-Flash medium Qwen 1 4.7 0/1 45.7s
#31 GLM 5.1 medium Z.ai 1 4.7 0/1 118.5s
#38 MiMo-V2-Flash medium Xiaomi 1 4.7 0/1 13.0s
#43 Kimi K2.5 medium Moonshot AI 1 4.7 0/1 150.8s
#57 Gemma 4 26B A4B none Google 1 4.7 0/1 7.07s
#67 MiniMax M2.5 medium Minimax 1 3.0 0/1 0ms
#86 Qwen3 Coder Next medium Qwen 1 4.7 0/1 1.69s
#87 GLM 4.7 Flash medium Z.ai 1 3.6 0/1 21.3s

Top modele după Număr de Timp expirat

Număr de Timp expirat vs Scor

Top modele după Timp de răspuns (mediu)

Top modele după Cost irosit estimat