Kegagalan Tidak ada jawaban
Lihat model AI mana yang paling sering mengalami Tidak ada jawaban, agar Anda bisa melihat risiko keandalan sebelum memilih.
Kategori
Dalam kategori Gabungan43 Dalam kategori Pemrograman39 Dalam kategori Spesifik domain35 Dalam kategori Pengetahuan umum27 Dalam kategori Trik anti-AI13 Dalam kategori Pemecahan teka-teki11 Dalam kategori Parsing dan ekstraksi data9 Dalam kategori Kepatuhan instruksi2 Dalam kategori Pemanggilan alat2
119/119
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Jumlah Tidak ada jawaban | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #56 | Qwen3.8 2.4T A95B low | Qwen | 2 | 8.1 | $2.672 | 15/22 | 119.0s |
| #63 | GLM 5.2 high | Z.ai | 2 | 8.0 | $1.188 | 14/22 | 69.9s |
| #66 | Kimi K3 max | Moonshot AI | 2 | 7.9 | $3.467 | 16/22 | 142.8s |
| #69 | Qwen3.8 27B low | Qwen | 2 | 7.9 | ~$0.071 | 15/22 | 39.1s |
| #73 | GLM 5.2 medium | Z.ai | 2 | 7.8 | $0.224 | 15/21 | 23.3s |
| #87 | Solar Pro 4 xhigh | Upstage | 2 | 7.6 | $0.050 | 12/22 | 134.9s |
| #105 | Qwen3.8 2.4T A95B high | Qwen | 2 | 7.4 | $2.357 | 14/22 | 120.6s |
| #118 | Muse Glimmer 30B high | Meta | 2 | 7.2 | $0.430 | 10/22 | 66.7s |
| #129 | GLM 5.1 medium | Z.ai | 2 | 7.0 | $0.727 | 12/22 | 58.8s |
| #134 | Kimi K2.5 medium | Moonshot AI | 2 | 7.0 | $0.479 | 10/22 | 98.2s |
| #149 | Gemma 4 26B A4B medium | 2 | 6.8 | $0.092 | 15/22 | 104.9s | |
| #155 | LongCat 2.0 high | Meituan | 2 | 6.7 | $0.492 | 9/22 | 153.3s |
| #166 | Laguna XS 2.1 medium | Poolside | 2 | 6.5 | $0.068 | 9/22 | 48.2s |
| #170 | Dots 3 Note Preview low | Dots Studio | 2 | 6.4 | $0.000 | 10/22 | 61.8s |
| #171 | Dots 3 Note Preview high | Dots Studio | 2 | 6.4 | $0.000 | 10/22 | 67.8s |