Clasament al eșecurilor pentru Eroare API

Vezi ce modele AI se lovesc cel mai des de Eroare API, ca să identifici riscurile de fiabilitate înainte să alegi.

Modele afișate

Eșecuri totale

161

Modelul cel mai afectat

Categorii

În categoria Programare45 În categoria Combinat26 În categoria Apelare instrumente17 În categoria Parsare și extragere de date14 În categoria Trucuri anti-AI14 În categoria Cultură generală13 În categoria Inteligență generală12 În categoria Rezolvare de puzzle-uri12 În categoria Specific domeniului7 În categoria Respectarea instrucțiunilor1

68/68

Rang	Model	Companie	Număr de Eroare API	Scor	Cost total	Teste corecte	Timp de răspuns (mediu)
#209	Step 3.5 Flash none	Stepfun	4	2.3	$0.020	6/12	39.0s
Total teste 12 Teste greșite 6 Cost total $0.020 Timp de răspuns (mediu) 39.0s
#210	LFM2-24B-A2B none	Liquid	4	2.2	$0.001	2/16	782ms
Total teste 16 Teste greșite 14 Cost total $0.001 Timp de răspuns (mediu) 782ms
#100	Hy3 preview medium	Tencent	3	6.5	$0.018	14/21	16.3s
Total teste 21 Teste greșite 7 Cost total $0.018 Timp de răspuns (mediu) 16.3s
#144	KAT-Coder-Air V2.5 high	Kwaipilot	3	5.6	$0.077	7/22	15.9s
Total teste 22 Teste greșite 15 Cost total $0.077 Timp de răspuns (mediu) 15.9s
#162	Ling-2.6-1T none	Inclusionai	3	5.3	$0.016	4/22	8.58s
Total teste 22 Teste greșite 18 Cost total $0.016 Timp de răspuns (mediu) 8.58s
#193	Elephant Alpha none	Openrouter	3	4.3	$0.000	5/21	1.22s
Total teste 21 Teste greșite 16 Cost total $0.000 Timp de răspuns (mediu) 1.22s
#195	Elephant Alpha medium	Openrouter	3	4.3	$0.000	6/21	1.27s
Total teste 21 Teste greșite 15 Cost total $0.000 Timp de răspuns (mediu) 1.27s
#202	Grok Build 0.1 none	X AI	3	4.0	$0.547	7/19	28.7s
Total teste 19 Teste greșite 12 Cost total $0.547 Timp de răspuns (mediu) 28.7s
#206	gpt-oss-120b none	OpenAI	3	3.7	$0.010	6/19	21.6s
Total teste 19 Teste greșite 13 Cost total $0.010 Timp de răspuns (mediu) 21.6s
#33	Kimi K3 max	Moonshot AI	2	8.0	$3.112	16/22	122.5s
Total teste 22 Teste greșite 6 Cost total $3.112 Timp de răspuns (mediu) 122.5s
#76	DeepSeek V3.2 medium	DeepSeek	2	7.0	$0.078	11/22	68.6s
Total teste 22 Teste greșite 11 Cost total $0.078 Timp de răspuns (mediu) 68.6s
#90	Qwen3.6 35B A3B medium	Qwen	2	6.7	$0.746	13/22	58.1s
Total teste 22 Teste greșite 9 Cost total $0.746 Timp de răspuns (mediu) 58.1s
#108	Ring-2.6-1T medium	Inclusionai	2	6.3	$0.103	11/22	68.7s
Total teste 22 Teste greșite 11 Cost total $0.103 Timp de răspuns (mediu) 68.7s
#110	Gemma 4 31B medium	Google	2	6.3	$0.163	14/22	75.4s
Total teste 22 Teste greșite 8 Cost total $0.163 Timp de răspuns (mediu) 75.4s
#115	Gemma 4 31B none	Google	2	6.2	$0.035	10/22	5.34s
Total teste 22 Teste greșite 12 Cost total $0.035 Timp de răspuns (mediu) 5.34s

←

1 2 3 4 5

→

Eșecuri Eroare API

Filtrează modelele

Top modele după Număr de Eroare API

Număr de Eroare API vs Scor

Top modele după Timp de răspuns (mediu)