AI BENCHY
AD
Track all your projects in one dashboard. Get ๐Ÿ“Šstats, ๐Ÿ”ฅheatmaps and ๐Ÿ‘€recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Categoriefouten

Domeinspecifiek: Verkeerd antwoord

Domeinspecifiek
Verkeerd antwoord

Zie welke AI-modellen op Domeinspecifiek het meest kans hebben op Verkeerd antwoord, zodat je zwakke punten sneller ziet.

Getoonde modellen

4

Totaal fouten

314

Meest getroffen model

Qwen3.6 Max Preview 3
Rang Model Bedrijf Verkeerd antwoord-aantal Categoriescore Correcte tests Responstijd (gem.)
#122 GLM 4.7 Flash none Z.ai 1 7.7 2/3 744ms
#130 MiniMax M2.7 medium Minimax 1 3.0 0/3 19.0s
#132 Mistral Small 4 medium Mistral 1 5.3 1/3 6.11s
#160 LFM2-24B-A2B none Liquid 1 5.9 1/3 287ms

Topmodellen op Verkeerd antwoord-aantal

Verkeerd antwoord-aantal vs Score

Topmodellen op Responstijd (gem.)

Topmodellen op Geschatte verspilde kosten