Kegagalan Kesalahan API
Lihat model AI mana yang paling sering mengalami Kesalahan API, agar Anda bisa melihat risiko keandalan sebelum memilih. Urutkan berdasarkan: Total Biaya ↓.
Model yang ditampilkan
15
Total kegagalan
161
Model yang paling terdampak
Grok 4.20 Multi Agent Beta 2Kategori
Dalam kategori Pemrograman45 Dalam kategori Gabungan26 Dalam kategori Pemanggilan alat17 Dalam kategori Parsing dan ekstraksi data14 Dalam kategori Trik anti-AI14 Dalam kategori Pengetahuan umum13 Dalam kategori Kecerdasan umum12 Dalam kategori Pemecahan teka-teki12 Dalam kategori Spesifik domain7 Dalam kategori Kepatuhan instruksi1
68/68
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Jumlah Kesalahan API | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #96 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.391 | 10/22 | 100.3s |
| #36 | Inkling medium | Thinkingmachines | 1 | 8.0 | $0.391 | 15/22 | 16.2s |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 1 | 7.4 | $0.387 | 11/22 | 19.5s |
| #139 | Gemini 3 PRO Preview medium | 4 | 6.0 | $0.385 | 14/21 | 9.05s | |
| #115 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #50 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.200 | 10/22 | 79.1s |
| #88 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 6.9 | $0.187 | 12/22 | 33.9s |
| #178 | MiniMax M2.7 medium | Minimax | 1 | 5.0 | $0.163 | 5/22 | 41.3s |
| #120 | Qwen3.5-Flash medium | Qwen | 1 | 6.2 | $0.139 | 12/22 | 84.8s |
| #136 | Step 3.5 Flash medium | Stepfun | 1 | 6.0 | $0.108 | 11/21 | 174.2s |
| #116 | Gemma 4 31B medium | 2 | 6.3 | $0.107 | 14/22 | 75.4s | |
| #114 | Ring-2.6-1T medium | Inclusionai | 2 | 6.3 | $0.103 | 11/22 | 68.7s |
| #173 | Mistral Small 4 medium | Mistral | 2 | 5.1 | $0.096 | 5/22 | 10.8s |
| #135 | Nemotron 3 Ultra none | NVIDIA | 1 | 6.1 | $0.095 | 8/22 | 3.87s |
| #80 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.6s |