Peringkat kegagalan Tidak ada jawaban

Lihat model AI mana yang paling sering mengalami Tidak ada jawaban, agar Anda bisa melihat risiko keandalan sebelum memilih. Urutkan berdasarkan: Waktu respons (rata-rata) ↑.

Model yang ditampilkan

Total kegagalan

Model yang paling terdampak

Gemini 3.1 Flash Lite Preview 1

Kategori

Dalam kategori Gabungan29 Dalam kategori Pemrograman18 Dalam kategori Pengetahuan umum13 Dalam kategori Parsing dan ekstraksi data8 Dalam kategori Spesifik domain8 Dalam kategori Trik anti-AI4 Dalam kategori Pemecahan teka-teki3 Dalam kategori Kepatuhan instruksi2 Dalam kategori Pemanggilan alat2

67/67

Peringkat	Model	Perusahaan	Jumlah Tidak ada jawaban	Skor	Total Biaya	Tes benar	Waktu respons (rata-rata)
#106	Gemini 3.1 Flash Lite Preview none	Google	1	6.4	$0.052	12/22	1.58s
Total Tes 22 Tes Salah 10 Total Biaya $0.052 Waktu respons (rata-rata) 1.58s
#132	GPT-5.6 Terra none	OpenAI	1	6.0	$0.349	8/22	1.65s
Total Tes 22 Tes Salah 14 Total Biaya $0.349 Waktu respons (rata-rata) 1.65s
#122	Gemini 3.1 Flash Lite none	Google	1	6.1	$0.046	9/22	1.75s
Total Tes 22 Tes Salah 13 Total Biaya $0.046 Waktu respons (rata-rata) 1.75s
#120	Gemini 3.1 Flash Lite minimal	Google	1	6.1	$0.047	10/22	1.86s
Total Tes 22 Tes Salah 12 Total Biaya $0.047 Waktu respons (rata-rata) 1.86s
#174	GPT-4o-mini none	OpenAI	1	5.0	$0.010	5/22	1.99s
Total Tes 22 Tes Salah 17 Total Biaya $0.010 Waktu respons (rata-rata) 1.99s
#180	GPT-5.4 Nano none	OpenAI	1	4.8	$0.041	4/22	2.57s
Total Tes 22 Tes Salah 18 Total Biaya $0.041 Waktu respons (rata-rata) 2.57s
#89	Gemini 3 Flash Preview none	Google	1	6.8	$0.085	13/22	2.95s
Total Tes 22 Tes Salah 9 Total Biaya $0.085 Waktu respons (rata-rata) 2.95s
#154	MiMo-V2.5-Pro none	Xiaomi	1	5.5	$0.068	6/22	4.12s
Total Tes 22 Tes Salah 16 Total Biaya $0.068 Waktu respons (rata-rata) 4.12s
#116	Seed-2.0-Lite none	Bytedance Seed	1	6.2	$0.066	8/22	4.40s
Total Tes 22 Tes Salah 14 Total Biaya $0.066 Waktu respons (rata-rata) 4.40s
#168	MiMo-V2.5 none	Xiaomi	1	5.1	$0.025	5/22	4.62s
Total Tes 22 Tes Salah 17 Total Biaya $0.025 Waktu respons (rata-rata) 4.62s
#66	Claude Opus 4.8 none	Anthropic	1	7.3	$1.166	13/22	4.91s
Total Tes 22 Tes Salah 9 Total Biaya $1.166 Waktu respons (rata-rata) 4.91s
#161	Qwen3.6 35B A3B none	Qwen	1	5.3	$0.061	4/22	5.52s
Total Tes 22 Tes Salah 18 Total Biaya $0.061 Waktu respons (rata-rata) 5.52s
#112	Claude Sonnet 5 none	Anthropic	2	6.3	$0.548	8/22	6.04s
Total Tes 22 Tes Salah 14 Total Biaya $0.548 Waktu respons (rata-rata) 6.04s
#151	GLM 5.1 none	Z.ai	1	5.5	$0.164	7/22	6.70s
Total Tes 22 Tes Salah 15 Total Biaya $0.164 Waktu respons (rata-rata) 6.70s
#198	Laguna Xs.2 medium	Poolside	2	4.1	$0.015	6/19	6.73s
Total Tes 19 Tes Salah 13 Total Biaya $0.015 Waktu respons (rata-rata) 6.73s

1 2 3 4 5

→

Kegagalan Tidak ada jawaban

Filter model

Model teratas menurut Jumlah Tidak ada jawaban

Jumlah Tidak ada jawaban vs Skor

Model teratas menurut Waktu respons (rata-rata)