AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Eșecuri pe categorii AI BENCHY

Inteligență generală: Eroare API

Inteligență generală
Eroare API

Vezi ce modele AI au cele mai mari șanse să întâmpine Eroare API la Inteligență generală, ca să găsești mai repede punctele slabe. Sortează după: Teste corecte ↑.

Modele afișate

12

Eșecuri totale

12

Modelul cel mai afectat

Nemotron 3 Ultra 550b A55b 1
Rang Model Companie Număr de Eroare API Scor de categorie Teste corecte Timp de răspuns (mediu)
#41 Nemotron 3 Ultra 550b A55b medium NVIDIA 1 3.7 0/1 2.52s
#72 DeepSeek V3.2 medium DeepSeek 1 3.4 0/1 58.3s
#82 Hy3 preview high Tencent 1 3.0 0/1 0ms
#89 Hy3 preview low Tencent 1 3.0 0/1 0ms
#92 Laguna M.1 medium Poolside 1 3.0 0/1 0ms
#93 Qwen3.6 Plus Preview medium Qwen 1 3.0 0/1 0ms
#107 Laguna Xs.2 medium Poolside 1 3.0 0/1 0ms
#133 DeepSeek V3.2 none DeepSeek 1 4.7 0/1 9.32s
#145 Laguna M.1 none Poolside 1 3.0 0/1 0ms
#146 Laguna Xs.2 none Poolside 1 3.0 0/1 0ms
#149 Nemotron 3 Nano Omni 30b A3b Reasoning medium NVIDIA 1 3.0 0/1 0ms
#162 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 1 3.0 0/1 0ms

Top modele după Număr de Eroare API

Număr de Eroare API vs Scor

Top modele după Timp de răspuns (mediu)

Top modele după Cost irosit estimat