API-fout-fouten
Zie welke AI-modellen het vaakst tegen API-fout aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Totale kosten โ.
Categorieรซn
In categorie Programmeren45 In categorie Gecombineerd26 In categorie Toolaanroepen17 In categorie Anti-AI-trucs14 In categorie Gegevensparsering en extractie14 In categorie Algemene kennis13 In categorie Algemene intelligentie12 In categorie Puzzeloplossing12 In categorie Domeinspecifiek7 In categorie Instructies opvolgen1
68/68
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | API-fout-aantal | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #91 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.391 | 10/22 | 100.3s |
| #32 | Inkling medium | Thinkingmachines | 1 | 8.0 | $0.391 | 15/22 | 16.2s |
| #62 | KAT-Coder-Pro V2.5 low | Kwaipilot | 1 | 7.4 | $0.387 | 11/22 | 19.5s |
| #133 | Gemini 3 PRO Preview medium | 4 | 6.0 | $0.385 | 14/21 | 9.05s | |
| #109 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #46 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.200 | 10/22 | 79.1s |
| #84 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 6.9 | $0.187 | 12/22 | 33.9s |
| #172 | MiniMax M2.7 medium | Minimax | 1 | 5.0 | $0.163 | 5/22 | 41.3s |
| #110 | Gemma 4 31B medium | 2 | 6.3 | $0.163 | 14/22 | 75.4s | |
| #114 | Qwen3.5-Flash medium | Qwen | 1 | 6.2 | $0.139 | 12/22 | 84.8s |
| #130 | Step 3.5 Flash medium | Stepfun | 1 | 6.0 | $0.108 | 11/21 | 174.2s |
| #108 | Ring-2.6-1T medium | Inclusionai | 2 | 6.3 | $0.103 | 11/22 | 68.7s |
| #167 | Mistral Small 4 medium | Mistral | 2 | 5.1 | $0.096 | 5/22 | 10.8s |
| #129 | Nemotron 3 Ultra none | NVIDIA | 1 | 6.1 | $0.095 | 8/22 | 3.87s |
| #76 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.6s |