Kegagalan Kesalahan API
Lihat model AI mana yang paling sering mengalami Kesalahan API, agar Anda bisa melihat risiko keandalan sebelum memilih. Urutkan berdasarkan: Skor ↓.
Kategori
Dalam kategori Pemrograman45 Dalam kategori Gabungan26 Dalam kategori Pemanggilan alat17 Dalam kategori Parsing dan ekstraksi data14 Dalam kategori Trik anti-AI14 Dalam kategori Pengetahuan umum13 Dalam kategori Kecerdasan umum12 Dalam kategori Pemecahan teka-teki12 Dalam kategori Spesifik domain7 Dalam kategori Kepatuhan instruksi1
68/68
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Jumlah Kesalahan API | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #27 | Muse Spark 1.1 high | Meta | 1 | 8.1 | $1.694 | 12/22 | 31.5s |
| #32 | Inkling medium | Thinkingmachines | 1 | 8.0 | $0.391 | 15/22 | 16.2s |
| #33 | Kimi K3 max | Moonshot AI | 2 | 8.0 | $3.112 | 16/22 | 122.5s |
| #37 | Qwen3.6 Plus medium | Qwen | 1 | 7.8 | $0.405 | 15/22 | 43.1s |
| #46 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.200 | 10/22 | 79.1s |
| #51 | Nemotron 3 Ultra medium | NVIDIA | 1 | 7.5 | $0.774 | 13/22 | 32.2s |
| #52 | Kimi K2.7 Code medium | Moonshot AI | 1 | 7.5 | $0.751 | 12/22 | 84.2s |
| #57 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 1 | 7.5 | $0.437 | 14/22 | 89.2s |
| #60 | LongCat 2.0 medium | Meituan | 1 | 7.4 | $0.478 | 12/22 | 136.6s |
| #62 | KAT-Coder-Pro V2.5 low | Kwaipilot | 1 | 7.4 | $0.387 | 11/22 | 19.5s |
| #74 | GLM 5.1 medium | Z.ai | 1 | 7.1 | $0.535 | 13/22 | 46.8s |
| #76 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.6s |
| #79 | Gemini 3.5 Flash none | 4 | 7.0 | $1.079 | 15/22 | 9.93s | |
| #81 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 1 | 6.9 | $0.467 | 11/22 | 24.0s |
| #84 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 6.9 | $0.187 | 12/22 | 33.9s |