কোন উত্তর নেই ব্যর্থতা র‌্যাঙ্কিং

দেখুন কোন AI মডেলগুলো সবচেয়ে বেশি কোন উত্তর নেই সমস্যায় পড়ে, যাতে বেছে নেওয়ার আগে নির্ভরযোগ্যতার ঝুঁকি বুঝতে পারেন। সাজান: প্রতিক্রিয়া সময় (গড়) ↑.

দেখানো মডেল

মোট ব্যর্থতা

সবচেয়ে বেশি প্রভাবিত মডেল

Gemini 3.1 Flash Lite Preview 1

বিভাগ

সমন্বিত বিভাগে29 কোডিং বিভাগে18 সাধারণ জ্ঞান বিভাগে13 ডেটা পার্সিং ও নিষ্কাশন বিভাগে8 ডোমেইন-নির্দিষ্ট বিভাগে8 অ্যান্টি-এআই কৌশল বিভাগে4 ধাঁধা সমাধান বিভাগে3 টুল কলিং বিভাগে2 নির্দেশনা অনুসরণ বিভাগে2

67/67

র‍্যাঙ্ক	মডেল	কোম্পানি	কোন উত্তর নেই সংখ্যা	স্কোর	মোট খরচ	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)
#106	Gemini 3.1 Flash Lite Preview none	Google	1	6.4	$0.052	12/22	1.58s
মোট টেস্ট 22 ভুল টেস্ট 10 মোট খরচ $0.052 প্রতিক্রিয়া সময় (গড়) 1.58s
#132	GPT-5.6 Terra none	OpenAI	1	6.0	$0.349	8/22	1.65s
মোট টেস্ট 22 ভুল টেস্ট 14 মোট খরচ $0.349 প্রতিক্রিয়া সময় (গড়) 1.65s
#122	Gemini 3.1 Flash Lite none	Google	1	6.1	$0.046	9/22	1.75s
মোট টেস্ট 22 ভুল টেস্ট 13 মোট খরচ $0.046 প্রতিক্রিয়া সময় (গড়) 1.75s
#120	Gemini 3.1 Flash Lite minimal	Google	1	6.1	$0.047	10/22	1.86s
মোট টেস্ট 22 ভুল টেস্ট 12 মোট খরচ $0.047 প্রতিক্রিয়া সময় (গড়) 1.86s
#174	GPT-4o-mini none	OpenAI	1	5.0	$0.010	5/22	1.99s
মোট টেস্ট 22 ভুল টেস্ট 17 মোট খরচ $0.010 প্রতিক্রিয়া সময় (গড়) 1.99s
#180	GPT-5.4 Nano none	OpenAI	1	4.8	$0.041	4/22	2.57s
মোট টেস্ট 22 ভুল টেস্ট 18 মোট খরচ $0.041 প্রতিক্রিয়া সময় (গড়) 2.57s
#89	Gemini 3 Flash Preview none	Google	1	6.8	$0.085	13/22	2.95s
মোট টেস্ট 22 ভুল টেস্ট 9 মোট খরচ $0.085 প্রতিক্রিয়া সময় (গড়) 2.95s
#154	MiMo-V2.5-Pro none	Xiaomi	1	5.5	$0.068	6/22	4.12s
মোট টেস্ট 22 ভুল টেস্ট 16 মোট খরচ $0.068 প্রতিক্রিয়া সময় (গড়) 4.12s
#116	Seed-2.0-Lite none	Bytedance Seed	1	6.2	$0.066	8/22	4.40s
মোট টেস্ট 22 ভুল টেস্ট 14 মোট খরচ $0.066 প্রতিক্রিয়া সময় (গড়) 4.40s
#168	MiMo-V2.5 none	Xiaomi	1	5.1	$0.025	5/22	4.62s
মোট টেস্ট 22 ভুল টেস্ট 17 মোট খরচ $0.025 প্রতিক্রিয়া সময় (গড়) 4.62s
#66	Claude Opus 4.8 none	Anthropic	1	7.3	$1.166	13/22	4.91s
মোট টেস্ট 22 ভুল টেস্ট 9 মোট খরচ $1.166 প্রতিক্রিয়া সময় (গড়) 4.91s
#161	Qwen3.6 35B A3B none	Qwen	1	5.3	$0.061	4/22	5.52s
মোট টেস্ট 22 ভুল টেস্ট 18 মোট খরচ $0.061 প্রতিক্রিয়া সময় (গড়) 5.52s
#112	Claude Sonnet 5 none	Anthropic	2	6.3	$0.548	8/22	6.04s
মোট টেস্ট 22 ভুল টেস্ট 14 মোট খরচ $0.548 প্রতিক্রিয়া সময় (গড়) 6.04s
#151	GLM 5.1 none	Z.ai	1	5.5	$0.164	7/22	6.70s
মোট টেস্ট 22 ভুল টেস্ট 15 মোট খরচ $0.164 প্রতিক্রিয়া সময় (গড়) 6.70s
#198	Laguna Xs.2 medium	Poolside	2	4.1	$0.015	6/19	6.73s
মোট টেস্ট 19 ভুল টেস্ট 13 মোট খরচ $0.015 প্রতিক্রিয়া সময় (গড়) 6.73s

1 2 3 4 5

→

কোন উত্তর নেই ব্যর্থতা

মডেল ফিল্টার করুন

কোন উত্তর নেই সংখ্যা অনুযায়ী শীর্ষ মডেল

কোন উত্তর নেই সংখ্যা বনাম স্কোর

প্রতিক্রিয়া সময় (গড়) অনুযায়ী শীর্ষ মডেল