AI BENCHY
Advertise here

Eșecuri pe categorii AI BENCHY

Cultură generală: Eroare API

Cultură generală
Eroare API

Vezi ce modele AI au cele mai mari șanse să întâmpine Eroare API la Cultură generală, ca să găsești mai repede punctele slabe. Sortează după: Timp de răspuns (mediu) ↓.

Modele afișate

12

Eșecuri totale

12

Modelul cel mai afectat

Qwen3.5-9B 1
Rang Model Companie Număr de Eroare API Scor de categorie Teste corecte Timp de răspuns (mediu)
#161 Qwen3.5-9B medium Qwen 1 3.0 0/1 177.0s
#35 Gemini 3 PRO Preview medium Google 1 3.0 0/1 0ms
#92 Laguna M.1 medium Poolside 1 3.0 0/1 0ms
#93 Qwen3.6 Plus Preview medium Qwen 1 3.0 0/1 0ms
#107 Laguna Xs.2 medium Poolside 1 3.0 0/1 0ms
#136 Elephant Alpha medium Openrouter 1 3.0 0/1 0ms
#137 Elephant Alpha none Openrouter 1 3.0 0/1 0ms
#145 Laguna M.1 none Poolside 1 3.0 0/1 0ms
#146 Laguna Xs.2 none Poolside 1 3.0 0/1 0ms
#149 Nemotron 3 Nano Omni 30b A3b Reasoning medium NVIDIA 1 3.0 0/1 0ms
#159 Ling-2.6-1T none Inclusionai 1 3.0 0/1 0ms
#162 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 1 3.0 0/1 0ms

Top modele după Număr de Eroare API

Număr de Eroare API vs Scor

Top modele după Timp de răspuns (mediu)

Top modele după Cost irosit estimat