API-fout-fouten
Zie welke AI-modellen het vaakst tegen API-fout aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Correcte tests โ.
Categorieรซn
In categorie Programmeren45 In categorie Gecombineerd26 In categorie Toolaanroepen17 In categorie Anti-AI-trucs14 In categorie Gegevensparsering en extractie14 In categorie Algemene kennis13 In categorie Algemene intelligentie12 In categorie Puzzeloplossing12 In categorie Domeinspecifiek7 In categorie Instructies opvolgen1
68/68
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | API-fout-aantal | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #60 | LongCat 2.0 medium | Meituan | 1 | 7.4 | $0.478 | 12/22 | 136.6s |
| #84 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 6.9 | $0.187 | 12/22 | 33.9s |
| #114 | Qwen3.5-Flash medium | Qwen | 1 | 6.2 | $0.139 | 12/22 | 84.8s |
| #130 | Step 3.5 Flash medium | Stepfun | 1 | 6.0 | $0.108 | 11/21 | 174.2s |
| #135 | Hy3 preview high | Tencent | 7 | 5.9 | $0.048 | 11/21 | 56.6s |
| #62 | KAT-Coder-Pro V2.5 low | Kwaipilot | 1 | 7.4 | $0.387 | 11/22 | 19.5s |
| #76 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.6s |
| #81 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 1 | 6.9 | $0.467 | 11/22 | 24.0s |
| #108 | Ring-2.6-1T medium | Inclusionai | 2 | 6.3 | $0.103 | 11/22 | 68.7s |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 1 | 6.2 | $0.837 | 11/22 | 112.5s |
| #209 | Step 3.5 Flash none | Stepfun | 4 | 2.3 | $0.020 | 6/12 | 39.0s |
| #134 | Mimo V2 Omni medium | Xiaomi | 1 | 5.9 | $0.683 | 10/21 | 41.2s |
| #153 | Hy3 preview low | Tencent | 7 | 5.5 | $0.015 | 10/21 | 24.6s |
| #175 | Qwen3.6 Plus Preview medium | Qwen | 8 | 4.9 | $0.000 | 9/19 | 15.2s |
| #186 | Laguna M.1 medium | Poolside | 4 | 4.7 | $0.033 | 9/19 | 14.7s |