AI BENCHY
Advertise here

Eșecuri AI BENCHY

Eșecuri Eroare API

Vezi ce modele AI se lovesc cel mai des de Eroare API, ca să identifici riscurile de fiabilitate înainte să alegi. Sortează după: Timp de răspuns (mediu) ↑.

Modele afișate

15

Eșecuri totale

144

Rang Model Companie Număr de Eroare API Scor Teste corecte Timp de răspuns (mediu)
#162 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 6 4.1 2/19 728ms
#160 LFM2-24B-A2B none Liquid 4 4.2 2/16 782ms
#146 Laguna Xs.2 none Poolside 4 4.8 5/19 806ms
#137 Elephant Alpha none Openrouter 3 5.1 5/21 1.22s
#136 Elephant Alpha medium Openrouter 3 5.1 6/21 1.27s
#120 Mimo V2 PRO none Xiaomi 1 5.6 7/21 2.27s
#101 Mimo V2 Omni none Xiaomi 1 6.0 8/21 2.44s
#152 MiMo-V2-Flash none Xiaomi 1 4.6 4/21 2.76s
#145 Laguna M.1 none Poolside 4 4.8 4/19 2.89s
#151 Trinity Large Preview none Arcee AI 2 4.6 4/21 2.98s
#153 Qwen3.6 35B A3B none Qwen 2 4.6 4/21 3.73s
#85 Gemma 4 31B none Google 2 6.5 10/21 4.05s
#116 Hunter Alpha none OpenRouter 1 5.7 6/18 4.70s
#107 Laguna Xs.2 medium Poolside 4 5.8 6/19 6.73s
#159 Ling-2.6-1T none Inclusionai 3 4.3 3/21 7.72s

Top modele după Număr de Eroare API

Număr de Eroare API vs Scor

Top modele după Timp de răspuns (mediu)