Clasament al eșecurilor pentru Eroare API

Vezi ce modele AI se lovesc cel mai des de Eroare API, ca să identifici riscurile de fiabilitate înainte să alegi.

Modele afișate

Eșecuri totale

159

Modelul cel mai afectat

Categorii

În categoria Programare44 În categoria Combinat25 În categoria Apelare instrumente17 În categoria Parsare și extragere de date14 În categoria Trucuri anti-AI14 În categoria Cultură generală13 În categoria Inteligență generală12 În categoria Rezolvare de puzzle-uri12 În categoria Specific domeniului7 În categoria Respectarea instrucțiunilor1

66/66

Rang	Model	Companie	Număr de Eroare API	Scor	Cost total	Teste corecte	Timp de răspuns (mediu)
#171	Qwen3.6 Plus Preview medium	Qwen	8	4.9	$0.000	9/19	15.2s
Total teste 19 Teste greșite 10 Cost total $0.000 Timp de răspuns (mediu) 15.2s
#131	Hy3 preview high	Tencent	7	5.9	$0.048	11/21	56.6s
Total teste 21 Teste greșite 10 Cost total $0.048 Timp de răspuns (mediu) 56.6s
#149	Hy3 preview low	Tencent	7	5.5	$0.015	10/21	24.6s
Total teste 21 Teste greșite 11 Cost total $0.015 Timp de răspuns (mediu) 24.6s
#175	Ring-2.6-1T none	Inclusionai	6	4.8	$0.026	9/22	55.1s
Total teste 22 Teste greșite 13 Cost total $0.026 Timp de răspuns (mediu) 55.1s
#203	Nemotron 3 Nano Omni 30b A3b Reasoning medium	NVIDIA	6	3.4	$0.000	4/19	17.1s
Total teste 19 Teste greșite 15 Cost total $0.000 Timp de răspuns (mediu) 17.1s
#204	Nemotron 3 Nano Omni 30b A3b Reasoning none	NVIDIA	6	3.2	$0.000	2/19	728ms
Total teste 19 Teste greșite 17 Cost total $0.000 Timp de răspuns (mediu) 728ms
#78	Gemini 3.5 Flash none	Google	4	7.0	$1.079	15/22	9.93s
Total teste 22 Teste greșite 7 Cost total $1.079 Timp de răspuns (mediu) 9.93s
#129	Gemini 3 PRO Preview medium	Google	4	6.0	$0.385	14/21	9.05s
Total teste 21 Teste greșite 7 Cost total $0.385 Timp de răspuns (mediu) 9.05s
#136	Nemotron 3 Super medium	NVIDIA	4	5.7	$0.066	8/22	52.0s
Total teste 22 Teste greșite 14 Cost total $0.066 Timp de răspuns (mediu) 52.0s
#169	DeepSeek V3.2 none	DeepSeek	4	5.0	$0.054	6/22	18.3s
Total teste 22 Teste greșite 16 Cost total $0.054 Timp de răspuns (mediu) 18.3s
#182	Laguna M.1 medium	Poolside	4	4.7	$0.033	9/19	14.7s
Total teste 19 Teste greșite 10 Cost total $0.033 Timp de răspuns (mediu) 14.7s
#188	Laguna M.1 none	Poolside	4	4.4	$0.009	4/19	2.89s
Total teste 19 Teste greșite 15 Cost total $0.009 Timp de răspuns (mediu) 2.89s
#194	Laguna Xs.2 medium	Poolside	4	4.1	$0.015	6/19	6.73s
Total teste 19 Teste greșite 13 Cost total $0.015 Timp de răspuns (mediu) 6.73s
#195	Hy3 preview none	Tencent	4	4.0	$0.003	4/21	12.9s
Total teste 21 Teste greșite 17 Cost total $0.003 Timp de răspuns (mediu) 12.9s
#201	Laguna Xs.2 none	Poolside	4	3.8	$0.004	5/19	806ms
Total teste 19 Teste greșite 14 Cost total $0.004 Timp de răspuns (mediu) 806ms

1 2 3 4 5

→

Eșecuri Eroare API

Filtrează modelele

Top modele după Număr de Eroare API

Număr de Eroare API vs Scor

Top modele după Timp de răspuns (mediu)