AI BENCHY
AD
Track all your projects in one dashboard. Get ๐Ÿ“Šstats, ๐Ÿ”ฅheatmaps and ๐Ÿ‘€recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Fouten

API-fout-fouten

Zie welke AI-modellen het vaakst tegen API-fout aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Responstijd (gem.) โ†‘.

Getoonde modellen

3

Totaal fouten

27

Meest getroffen model

Step 3.5 Flash 1
Rang Model Bedrijf API-fout-aantal Score Correcte tests Responstijd (gem.)
#14 Gemma 4 31B medium Google 2 8.3 13/18 24.9s
#43 Qwen3.5-35B-A3B medium Qwen 1 7.4 10/18 44.5s
#32 Qwen3.5-Flash medium Qwen 1 7.8 11/18 66.7s

Topmodellen op API-fout-aantal

API-fout-aantal vs Score

Topmodellen op Responstijd (gem.)