API ত্রুটি ব্যর্থতা র‌্যাঙ্কিং

দেখুন কোন AI মডেলগুলো সবচেয়ে বেশি API ত্রুটি সমস্যায় পড়ে, যাতে বেছে নেওয়ার আগে নির্ভরযোগ্যতার ঝুঁকি বুঝতে পারেন। সাজান: সঠিক টেস্ট ↓.

দেখানো মডেল

মোট ব্যর্থতা

161

সবচেয়ে বেশি প্রভাবিত মডেল

Kimi K3 2

বিভাগ

কোডিং বিভাগে45 সমন্বিত বিভাগে26 টুল কলিং বিভাগে17 অ্যান্টি-এআই কৌশল বিভাগে14 ডেটা পার্সিং ও নিষ্কাশন বিভাগে14 সাধারণ জ্ঞান বিভাগে13 Sadharon Buddhimotta বিভাগে12 ধাঁধা সমাধান বিভাগে12 ডোমেইন-নির্দিষ্ট বিভাগে7 নির্দেশনা অনুসরণ বিভাগে1

68/68

র‍্যাঙ্ক	মডেল	কোম্পানি	API ত্রুটি সংখ্যা	স্কোর	মোট খরচ	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)
#60	LongCat 2.0 medium	Meituan	1	7.4	$0.478	12/22	136.6s
মোট টেস্ট 22 ভুল টেস্ট 10 মোট খরচ $0.478 প্রতিক্রিয়া সময় (গড়) 136.6s
#84	MiMo-V2.5-Pro medium	Xiaomi	1	6.9	$0.187	12/22	33.9s
মোট টেস্ট 22 ভুল টেস্ট 10 মোট খরচ $0.187 প্রতিক্রিয়া সময় (গড়) 33.9s
#114	Qwen3.5-Flash medium	Qwen	1	6.2	$0.139	12/22	84.8s
মোট টেস্ট 22 ভুল টেস্ট 10 মোট খরচ $0.139 প্রতিক্রিয়া সময় (গড়) 84.8s
#130	Step 3.5 Flash medium	Stepfun	1	6.0	$0.108	11/21	174.2s
মোট টেস্ট 21 ভুল টেস্ট 10 মোট খরচ $0.108 প্রতিক্রিয়া সময় (গড়) 174.2s
#135	Hy3 preview high	Tencent	7	5.9	$0.048	11/21	56.6s
মোট টেস্ট 21 ভুল টেস্ট 10 মোট খরচ $0.048 প্রতিক্রিয়া সময় (গড়) 56.6s
#62	KAT-Coder-Pro V2.5 low	Kwaipilot	1	7.4	$0.387	11/22	19.5s
মোট টেস্ট 22 ভুল টেস্ট 11 মোট খরচ $0.387 প্রতিক্রিয়া সময় (গড়) 19.5s
#76	DeepSeek V3.2 medium	DeepSeek	2	7.0	$0.078	11/22	68.6s
মোট টেস্ট 22 ভুল টেস্ট 11 মোট খরচ $0.078 প্রতিক্রিয়া সময় (গড়) 68.6s
#81	KAT-Coder-Pro V2.5 medium	Kwaipilot	1	6.9	$0.467	11/22	24.0s
মোট টেস্ট 22 ভুল টেস্ট 11 মোট খরচ $0.467 প্রতিক্রিয়া সময় (গড়) 24.0s
#108	Ring-2.6-1T medium	Inclusionai	2	6.3	$0.103	11/22	68.7s
মোট টেস্ট 22 ভুল টেস্ট 11 মোট খরচ $0.103 প্রতিক্রিয়া সময় (গড়) 68.7s
#119	Qwen3.5-35B-A3B medium	Qwen	1	6.2	$0.837	11/22	112.5s
মোট টেস্ট 22 ভুল টেস্ট 11 মোট খরচ $0.837 প্রতিক্রিয়া সময় (গড়) 112.5s
#209	Step 3.5 Flash none	Stepfun	4	2.3	$0.020	6/12	39.0s
মোট টেস্ট 12 ভুল টেস্ট 6 মোট খরচ $0.020 প্রতিক্রিয়া সময় (গড়) 39.0s
#134	Mimo V2 Omni medium	Xiaomi	1	5.9	$0.683	10/21	41.2s
মোট টেস্ট 21 ভুল টেস্ট 11 মোট খরচ $0.683 প্রতিক্রিয়া সময় (গড়) 41.2s
#153	Hy3 preview low	Tencent	7	5.5	$0.015	10/21	24.6s
মোট টেস্ট 21 ভুল টেস্ট 11 মোট খরচ $0.015 প্রতিক্রিয়া সময় (গড়) 24.6s
#175	Qwen3.6 Plus Preview medium	Qwen	8	4.9	$0.000	9/19	15.2s
মোট টেস্ট 19 ভুল টেস্ট 10 মোট খরচ $0.000 প্রতিক্রিয়া সময় (গড়) 15.2s
#186	Laguna M.1 medium	Poolside	4	4.7	$0.033	9/19	14.7s
মোট টেস্ট 19 ভুল টেস্ট 10 মোট খরচ $0.033 প্রতিক্রিয়া সময় (গড়) 14.7s

←

1 2 3 4 5

→

API ত্রুটি ব্যর্থতা

মডেল ফিল্টার করুন

API ত্রুটি সংখ্যা অনুযায়ী শীর্ষ মডেল

API ত্রুটি সংখ্যা বনাম স্কোর

প্রতিক্রিয়া সময় (গড়) অনুযায়ী শীর্ষ মডেল