Foutenranglijst voor API-fout

Zie welke AI-modellen het vaakst tegen API-fout aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Responstijd (gem.) ↑.

Getoonde modellen

Totaal fouten

161

Meest getroffen model

Nemotron 3 Nano Omni 30b A3b Reasoning 6

Categorieën

In categorie Programmeren45 In categorie Gecombineerd26 In categorie Toolaanroepen17 In categorie Anti-AI-trucs14 In categorie Gegevensparsering en extractie14 In categorie Algemene kennis13 In categorie Algemene intelligentie12 In categorie Puzzeloplossing12 In categorie Domeinspecifiek7 In categorie Instructies opvolgen1

68/68

Rang	Model	Bedrijf	API-fout-aantal	Score	Totale kosten	Correcte tests	Responstijd (gem.)
#32	Inkling medium	Thinkingmachines	1	8.0	$0.391	15/22	16.2s
Totaal tests 22 Foute tests 7 Totale kosten $0.391 Responstijd (gem.) 16.2s
#100	Hy3 preview medium	Tencent	3	6.5	$0.018	14/21	16.3s
Totaal tests 21 Foute tests 7 Totale kosten $0.018 Responstijd (gem.) 16.3s
#207	Nemotron 3 Nano Omni 30b A3b Reasoning medium	NVIDIA	6	3.4	$0.000	4/19	17.1s
Totaal tests 19 Foute tests 15 Totale kosten $0.000 Responstijd (gem.) 17.1s
#173	DeepSeek V3.2 none	DeepSeek	4	5.0	$0.054	6/22	18.3s
Totaal tests 22 Foute tests 16 Totale kosten $0.054 Responstijd (gem.) 18.3s
#62	KAT-Coder-Pro V2.5 low	Kwaipilot	1	7.4	$0.387	11/22	19.5s
Totaal tests 22 Foute tests 11 Totale kosten $0.387 Responstijd (gem.) 19.5s
#113	MiMo-V2-Flash medium	Xiaomi	1	6.3	$0.043	12/21	20.1s
Totaal tests 21 Foute tests 9 Totale kosten $0.043 Responstijd (gem.) 20.1s
#206	gpt-oss-120b none	OpenAI	3	3.7	$0.010	6/19	21.6s
Totaal tests 19 Foute tests 13 Totale kosten $0.010 Responstijd (gem.) 21.6s
#109	Mimo V2 PRO medium	Xiaomi	1	6.3	$0.333	12/21	22.2s
Totaal tests 21 Foute tests 9 Totale kosten $0.333 Responstijd (gem.) 22.2s
#81	KAT-Coder-Pro V2.5 medium	Kwaipilot	1	6.9	$0.467	11/22	24.0s
Totaal tests 22 Foute tests 11 Totale kosten $0.467 Responstijd (gem.) 24.0s
#153	Hy3 preview low	Tencent	7	5.5	$0.015	10/21	24.6s
Totaal tests 21 Foute tests 11 Totale kosten $0.015 Responstijd (gem.) 24.6s
#202	Grok Build 0.1 none	X AI	3	4.0	$0.547	7/19	28.7s
Totaal tests 19 Foute tests 12 Totale kosten $0.547 Responstijd (gem.) 28.7s
#27	Muse Spark 1.1 high	Meta	1	8.1	$1.694	12/22	31.5s
Totaal tests 22 Foute tests 10 Totale kosten $1.694 Responstijd (gem.) 31.5s
#51	Nemotron 3 Ultra medium	NVIDIA	1	7.5	$0.774	13/22	32.2s
Totaal tests 22 Foute tests 9 Totale kosten $0.774 Responstijd (gem.) 32.2s
#84	MiMo-V2.5-Pro medium	Xiaomi	1	6.9	$0.187	12/22	33.9s
Totaal tests 22 Foute tests 10 Totale kosten $0.187 Responstijd (gem.) 33.9s
#209	Step 3.5 Flash none	Stepfun	4	2.3	$0.020	6/12	39.0s
Totaal tests 12 Foute tests 6 Totale kosten $0.020 Responstijd (gem.) 39.0s

←

1 2 3 4 5

→

API-fout-fouten

Modellen filteren

Topmodellen op API-fout-aantal

API-fout-aantal vs Score

Topmodellen op Responstijd (gem.)