AI BENCHY
Your ad here

Eșecuri pe categorii AI BENCHY

Rezolvare de puzzle-uri: Răspuns greșit

Rezolvare de puzzle-uri
Răspuns greșit

Vezi ce modele AI au cele mai mari șanse să întâmpine Răspuns greșit la Rezolvare de puzzle-uri, ca să găsești mai repede punctele slabe.

Modele afișate

5

Eșecuri totale

85

Modelul cel mai afectat

Kimi K2.5 3
Rang Model Companie Număr de Răspuns greșit Scor de categorie Teste corecte Timp de răspuns (mediu)
#86 GPT-5.4 Mini none OpenAI 1 5.4 1/3 860ms
#88 Nemotron 3 Super none NVIDIA 1 5.7 1/3 7.50s
#90 Qwen3.5-9B none Qwen 1 3.2 0/3 683ms
#92 Qwen3 Coder Next medium Qwen 1 3.1 0/3 2.30s
#98 LFM2-24B-A2B none Liquid 1 4.4 0/3 1.69s

Top modele după Număr de Răspuns greșit

Număr de Răspuns greșit vs Scor

Top modele după Timp de răspuns (mediu)

Top modele după Cost irosit estimat