Kegagalan Tidak ada jawaban
Lihat model AI mana yang paling sering mengalami Tidak ada jawaban, agar Anda bisa melihat risiko keandalan sebelum memilih. Urutkan berdasarkan: Tes benar ↓.
Kategori
Dalam kategori Gabungan43 Dalam kategori Pemrograman39 Dalam kategori Spesifik domain35 Dalam kategori Pengetahuan umum27 Dalam kategori Trik anti-AI13 Dalam kategori Pemecahan teka-teki11 Dalam kategori Parsing dan ekstraksi data9 Dalam kategori Kepatuhan instruksi2 Dalam kategori Pemanggilan alat2
119/119
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Jumlah Tidak ada jawaban | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #58 | Muse Glimmer 30B xhigh | Meta | 3 | 8.1 | $0.510 | 13/22 | 95.6s |
| #61 | DeepSeek V4 Flash 0731 low | DeepSeek | 1 | 8.0 | $0.044 | 13/22 | 77.6s |
| #67 | GPT-5.2 Chat none | OpenAI | 1 | 7.9 | $0.594 | 13/22 | 7.73s |
| #68 | Step 3.7 Flash medium | Stepfun | 1 | 7.9 | $0.495 | 13/22 | 23.5s |
| #77 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 7.8 | $0.236 | 13/22 | 47.9s |
| #111 | GLM 5.3 Flash high | Z.ai | 1 | 7.3 | $0.029 | 13/22 | 25.4s |
| #115 | Claude Opus 4.8 none | Anthropic | 1 | 7.3 | $1.166 | 13/22 | 4.92s |
| #148 | Gemini 3 Flash Preview none | 1 | 6.8 | $0.085 | 13/22 | 2.82s | |
| #179 | Gemma 4 31B medium | 1 | 6.2 | $0.100 | 13/22 | 78.6s | |
| #219 | Gemini 3.1 Flash Lite high | 1 | 5.6 | $2.044 | 10/18 | 62.0s | |
| #57 | GPT-5 Mini medium | OpenAI | 1 | 8.1 | $0.241 | 12/22 | 27.6s |
| #60 | Muse Spark 1.1 high | Meta | 1 | 8.0 | $2.253 | 12/22 | 36.9s |
| #87 | Solar Pro 4 xhigh | Upstage | 2 | 7.6 | $0.050 | 12/22 | 134.9s |
| #89 | Claude Opus 5 none | Anthropic | 1 | 7.5 | $1.550 | 12/22 | 7.65s |
| #104 | LongCat 2.0 medium | Meituan | 1 | 7.4 | $0.499 | 12/22 | 143.6s |