Foutenranglijst voor Verkeerd antwoord

Zie welke AI-modellen het vaakst tegen Verkeerd antwoord aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Responstijd (gem.) ↑.

Getoonde modellen

Totaal fouten

1585

Meest getroffen model

Nemotron 3 Nano Omni 30b A3b Reasoning 9

Categorieën

In categorie Domeinspecifiek421 In categorie Anti-AI-trucs293 In categorie Programmeren259 In categorie Puzzeloplossing204 In categorie Algemene kennis172 In categorie Gecombineerd69 In categorie Algemene intelligentie62 In categorie Instructies opvolgen61 In categorie Gegevensparsering en extractie41 In categorie Toolaanroepen3

215/215

Rang	Model	Bedrijf	Verkeerd antwoord-aantal	Score	Totale kosten	Correcte tests	Responstijd (gem.)
#174	MiMo-V2.5 none	Xiaomi	14	5.1	$0.025	5/22	4.62s
Totaal tests 22 Foute tests 17 Totale kosten $0.025 Responstijd (gem.) 4.62s
#202	Hunter Alpha none	OpenRouter	9	4.2	$0.000	6/18	4.70s
Totaal tests 18 Foute tests 12 Totale kosten $0.000 Responstijd (gem.) 4.70s
#109	Qwen3.5-27B none	Qwen	12	6.5	$0.090	8/22	4.76s
Totaal tests 22 Foute tests 14 Totale kosten $0.090 Responstijd (gem.) 4.76s
#70	Claude Opus 4.8 none	Anthropic	4	7.3	$1.166	13/22	4.91s
Totaal tests 22 Foute tests 9 Totale kosten $1.166 Responstijd (gem.) 4.91s
#123	GPT-5.6 Luna low	OpenAI	10	6.2	$0.249	10/22	5.04s
Totaal tests 22 Foute tests 12 Totale kosten $0.249 Responstijd (gem.) 5.04s
#129	Inkling low	Thinkingmachines	8	6.1	$0.187	10/22	5.15s
Totaal tests 22 Foute tests 12 Totale kosten $0.187 Responstijd (gem.) 5.15s
#117	LongCat 2.0 none	Meituan	14	6.3	$0.044	7/22	5.18s
Totaal tests 22 Foute tests 15 Totale kosten $0.044 Responstijd (gem.) 5.18s
#59	GPT-5.6 Terra low	OpenAI	8	7.5	$0.519	13/22	5.31s
Totaal tests 22 Foute tests 9 Totale kosten $0.519 Responstijd (gem.) 5.31s
#121	Gemma 4 31B none	Google	9	6.2	$0.021	10/22	5.34s
Totaal tests 22 Foute tests 12 Totale kosten $0.021 Responstijd (gem.) 5.34s
#167	Qwen3.6 35B A3B none	Qwen	13	5.3	$0.061	4/22	5.52s
Totaal tests 22 Foute tests 18 Totale kosten $0.061 Responstijd (gem.) 5.52s
#14	Gemini 3.5 Flash low	Google	2	8.9	$0.433	19/22	5.55s
Totaal tests 22 Foute tests 3 Totale kosten $0.433 Responstijd (gem.) 5.55s
#183	Nemotron 3 Super none	NVIDIA	15	4.9	$0.008	5/22	5.97s
Totaal tests 22 Foute tests 17 Totale kosten $0.008 Responstijd (gem.) 5.97s
#104	Gemini 3.5 Flash-Lite medium	Google	9	6.5	$0.369	12/22	6.01s
Totaal tests 22 Foute tests 10 Totale kosten $0.369 Responstijd (gem.) 6.01s
#118	Claude Sonnet 5 none	Anthropic	7	6.3	$0.548	8/22	6.04s
Totaal tests 22 Foute tests 14 Totale kosten $0.548 Responstijd (gem.) 6.04s
#124	Gemini 2.5 Flash none	Google	12	6.2	$0.017	9/22	6.20s
Totaal tests 22 Foute tests 13 Totale kosten $0.017 Responstijd (gem.) 6.20s

Verkeerd antwoord-fouten

Modellen filteren

Topmodellen op Verkeerd antwoord-aantal

Verkeerd antwoord-aantal vs Score

Topmodellen op Responstijd (gem.)