Verkeerd antwoord-fouten
Zie welke AI-modellen het vaakst tegen Verkeerd antwoord aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Responstijd (gem.) โ.
Getoonde modellen
15
Totaal fouten
1585
Meest getroffen model
Nemotron 3 Nano Omni 30b A3b Reasoning 9Categorieรซn
In categorie Domeinspecifiek421 In categorie Anti-AI-trucs293 In categorie Programmeren259 In categorie Puzzeloplossing204 In categorie Algemene kennis172 In categorie Gecombineerd69 In categorie Algemene intelligentie62 In categorie Instructies opvolgen61 In categorie Gegevensparsering en extractie41 In categorie Toolaanroepen3
215/215
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Verkeerd antwoord-aantal | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #139 | Gemini 3 PRO Preview medium | 3 | 6.0 | $0.385 | 14/21 | 9.05s | |
| #172 | Qwen3 Coder Next none | Qwen | 14 | 5.1 | $0.025 | 5/22 | 9.12s |
| #182 | GLM 4.7 Flash none | Z.ai | 13 | 4.9 | $0.016 | 6/22 | 9.15s |
| #101 | GLM 5.2 none | Z.ai | 8 | 6.6 | $0.128 | 12/22 | 9.34s |
| #31 | Gemini 3.5 Flash-Lite high | 6 | 8.1 | $0.584 | 14/22 | 9.48s | |
| #193 | Qwen3 Coder Next medium | Qwen | 13 | 4.7 | $0.032 | 4/22 | 9.61s |
| #187 | Grok 4.20 Multi Agent Beta medium | X AI | 4 | 4.8 | $5.599 | 8/18 | 9.69s |
| #137 | Grok 4.20 Beta medium | X AI | 3 | 6.0 | $0.750 | 14/18 | 9.75s |
| #113 | Qwen3.5 Plus 2026-02-15 none | Qwen | 12 | 6.4 | $0.073 | 10/22 | 9.85s |
| #154 | Owl Alpha none | Openrouter | 10 | 5.6 | $0.000 | 7/21 | 9.88s |
| #83 | Gemini 3.5 Flash none | 3 | 7.0 | $1.079 | 15/22 | 9.93s | |
| #164 | KAT-Coder-Air V2.5 low | Kwaipilot | 7 | 5.4 | $0.041 | 7/22 | 10.1s |
| #1 | Gemini 3.6 Flash medium | 1 | 9.9 | $0.831 | 21/22 | 10.1s | |
| #9 | GPT-5.5 low | OpenAI | 3 | 9.3 | $1.253 | 19/22 | 10.1s |
| #190 | Hunter Alpha medium | OpenRouter | 4 | 4.7 | $0.000 | 8/18 | 10.3s |