AI BENCHY
Advertise here

Eșecuri pe categorii AI BENCHY

Cultură generală: Eroare API

Cultură generală
Eroare API

Vezi ce modele AI au cele mai mari șanse să întâmpine Eroare API la Cultură generală, ca să găsești mai repede punctele slabe. Sortează după: Teste corecte ↓.

Modele afișate

12

Eșecuri totale

12

Modelul cel mai afectat

Gemini 3 PRO Preview 1
Rang Model Companie Număr de Eroare API Scor de categorie Teste corecte Timp de răspuns (mediu)
#35 Gemini 3 PRO Preview medium Google 1 3.0 0/1 0ms
#92 Laguna M.1 medium Poolside 1 3.0 0/1 0ms
#93 Qwen3.6 Plus Preview medium Qwen 1 3.0 0/1 0ms
#107 Laguna Xs.2 medium Poolside 1 3.0 0/1 0ms
#136 Elephant Alpha medium Openrouter 1 3.0 0/1 0ms
#137 Elephant Alpha none Openrouter 1 3.0 0/1 0ms
#145 Laguna M.1 none Poolside 1 3.0 0/1 0ms
#146 Laguna Xs.2 none Poolside 1 3.0 0/1 0ms
#149 Nemotron 3 Nano Omni 30b A3b Reasoning medium NVIDIA 1 3.0 0/1 0ms
#159 Ling-2.6-1T none Inclusionai 1 3.0 0/1 0ms
#161 Qwen3.5-9B medium Qwen 1 3.0 0/1 177.0s
#162 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 1 3.0 0/1 0ms

Top modele după Număr de Eroare API

Număr de Eroare API vs Scor

Top modele după Timp de răspuns (mediu)

Top modele după Cost irosit estimat