Peringkat kegagalan Kesalahan API

Lihat model AI mana yang paling sering mengalami Kesalahan API, agar Anda bisa melihat risiko keandalan sebelum memilih. Urutkan berdasarkan: Tes benar ↓.

Model yang ditampilkan

Total kegagalan

161

Model yang paling terdampak

Kimi K3 2

Kategori

Dalam kategori Pemrograman45 Dalam kategori Gabungan26 Dalam kategori Pemanggilan alat17 Dalam kategori Parsing dan ekstraksi data14 Dalam kategori Trik anti-AI14 Dalam kategori Pengetahuan umum13 Dalam kategori Kecerdasan umum12 Dalam kategori Pemecahan teka-teki12 Dalam kategori Spesifik domain7 Dalam kategori Kepatuhan instruksi1

68/68

Peringkat	Model	Perusahaan	Jumlah Kesalahan API	Skor	Total Biaya	Tes benar	Waktu respons (rata-rata)
#60	LongCat 2.0 medium	Meituan	1	7.4	$0.478	12/22	136.6s
Total Tes 22 Tes Salah 10 Total Biaya $0.478 Waktu respons (rata-rata) 136.6s
#84	MiMo-V2.5-Pro medium	Xiaomi	1	6.9	$0.187	12/22	33.9s
Total Tes 22 Tes Salah 10 Total Biaya $0.187 Waktu respons (rata-rata) 33.9s
#114	Qwen3.5-Flash medium	Qwen	1	6.2	$0.139	12/22	84.8s
Total Tes 22 Tes Salah 10 Total Biaya $0.139 Waktu respons (rata-rata) 84.8s
#130	Step 3.5 Flash medium	Stepfun	1	6.0	$0.108	11/21	174.2s
Total Tes 21 Tes Salah 10 Total Biaya $0.108 Waktu respons (rata-rata) 174.2s
#135	Hy3 preview high	Tencent	7	5.9	$0.048	11/21	56.6s
Total Tes 21 Tes Salah 10 Total Biaya $0.048 Waktu respons (rata-rata) 56.6s
#62	KAT-Coder-Pro V2.5 low	Kwaipilot	1	7.4	$0.387	11/22	19.5s
Total Tes 22 Tes Salah 11 Total Biaya $0.387 Waktu respons (rata-rata) 19.5s
#76	DeepSeek V3.2 medium	DeepSeek	2	7.0	$0.078	11/22	68.6s
Total Tes 22 Tes Salah 11 Total Biaya $0.078 Waktu respons (rata-rata) 68.6s
#81	KAT-Coder-Pro V2.5 medium	Kwaipilot	1	6.9	$0.467	11/22	24.0s
Total Tes 22 Tes Salah 11 Total Biaya $0.467 Waktu respons (rata-rata) 24.0s
#108	Ring-2.6-1T medium	Inclusionai	2	6.3	$0.103	11/22	68.7s
Total Tes 22 Tes Salah 11 Total Biaya $0.103 Waktu respons (rata-rata) 68.7s
#119	Qwen3.5-35B-A3B medium	Qwen	1	6.2	$0.837	11/22	112.5s
Total Tes 22 Tes Salah 11 Total Biaya $0.837 Waktu respons (rata-rata) 112.5s
#209	Step 3.5 Flash none	Stepfun	4	2.3	$0.020	6/12	39.0s
Total Tes 12 Tes Salah 6 Total Biaya $0.020 Waktu respons (rata-rata) 39.0s
#134	Mimo V2 Omni medium	Xiaomi	1	5.9	$0.683	10/21	41.2s
Total Tes 21 Tes Salah 11 Total Biaya $0.683 Waktu respons (rata-rata) 41.2s
#153	Hy3 preview low	Tencent	7	5.5	$0.015	10/21	24.6s
Total Tes 21 Tes Salah 11 Total Biaya $0.015 Waktu respons (rata-rata) 24.6s
#175	Qwen3.6 Plus Preview medium	Qwen	8	4.9	$0.000	9/19	15.2s
Total Tes 19 Tes Salah 10 Total Biaya $0.000 Waktu respons (rata-rata) 15.2s
#186	Laguna M.1 medium	Poolside	4	4.7	$0.033	9/19	14.7s
Total Tes 19 Tes Salah 10 Total Biaya $0.033 Waktu respons (rata-rata) 14.7s

←

1 2 3 4 5

→

Kegagalan Kesalahan API

Filter model

Model teratas menurut Jumlah Kesalahan API

Jumlah Kesalahan API vs Skor

Model teratas menurut Waktu respons (rata-rata)