Kegagalan Kesalahan API
Lihat model AI mana yang paling sering mengalami Kesalahan API, agar Anda bisa melihat risiko keandalan sebelum memilih. Urutkan berdasarkan: Waktu respons (rata-rata) ↓.
Kategori
Dalam kategori Pemrograman45 Dalam kategori Gabungan26 Dalam kategori Pemanggilan alat17 Dalam kategori Parsing dan ekstraksi data14 Dalam kategori Trik anti-AI14 Dalam kategori Pengetahuan umum13 Dalam kategori Kecerdasan umum12 Dalam kategori Pemecahan teka-teki12 Dalam kategori Spesifik domain7 Dalam kategori Kepatuhan instruksi1
68/68
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Jumlah Kesalahan API | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #130 | Step 3.5 Flash medium | Stepfun | 1 | 6.0 | $0.108 | 11/21 | 174.2s |
| #137 | North Mini Code medium | Cohere | 1 | 5.9 | $0.000 | 9/22 | 137.1s |
| #60 | LongCat 2.0 medium | Meituan | 1 | 7.4 | $0.478 | 12/22 | 136.6s |
| #33 | Kimi K3 max | Moonshot AI | 2 | 8.0 | $3.112 | 16/22 | 122.5s |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 1 | 6.2 | $0.837 | 11/22 | 112.5s |
| #91 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.391 | 10/22 | 100.3s |
| #57 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 1 | 7.5 | $0.437 | 14/22 | 89.2s |
| #114 | Qwen3.5-Flash medium | Qwen | 1 | 6.2 | $0.139 | 12/22 | 84.8s |
| #52 | Kimi K2.7 Code medium | Moonshot AI | 1 | 7.5 | $0.751 | 12/22 | 84.2s |
| #204 | Qwen3.5-9B medium | Qwen | 1 | 3.8 | $0.036 | 3/22 | 82.2s |
| #46 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.200 | 10/22 | 79.1s |
| #110 | Gemma 4 31B medium | 2 | 6.3 | $0.163 | 14/22 | 75.4s | |
| #108 | Ring-2.6-1T medium | Inclusionai | 2 | 6.3 | $0.103 | 11/22 | 68.7s |
| #76 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.6s |
| #90 | Qwen3.6 35B A3B medium | Qwen | 2 | 6.7 | $0.746 | 13/22 | 58.1s |