AI BENCHY
Advertise here

AI BENCHY Categoriefouten

Instructies opvolgen: Instructies niet gevolgd

Instructies opvolgen
Instructies niet gevolgd

Zie welke AI-modellen op Instructies opvolgen het meest kans hebben op Instructies niet gevolgd, zodat je zwakke punten sneller ziet.

Getoonde modellen

11

Totaal fouten

11

Meest getroffen model

Step 3.5 Flash 1
Rang Model Bedrijf Instructies niet gevolgd-aantal Categoriescore Correcte tests Responstijd (gem.)
#62 Step 3.5 Flash medium Stepfun 1 8.3 1/2 4.78s
#80 Mimo V2 Omni medium Xiaomi 1 8.3 1/2 4.99s
#86 Grok 4.1 Fast medium X AI 1 6.5 1/2 4.63s
#105 Nemotron 3 Super medium NVIDIA 1 7.3 1/2 6.97s
#129 MiniMax M2.5 medium Minimax 1 7.5 1/2 621ms
#130 MiniMax M2.7 medium Minimax 1 3.8 0/2 12.8s
#149 Nemotron 3 Nano Omni 30b A3b Reasoning medium NVIDIA 1 7.3 1/2 1.37s
#151 Trinity Large Preview none Arcee AI 1 3.5 0/2 822ms
#157 Grok 4.1 Fast none X AI 1 3.0 0/2 685ms
#162 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 1 4.8 0/2 541ms
#163 Granite 4.1 8B none IBM Granite 1 3.6 0/2 344ms

Topmodellen op Instructies niet gevolgd-aantal

Instructies niet gevolgd-aantal vs Score

Topmodellen op Responstijd (gem.)

Topmodellen op Geschatte verspilde kosten