টুল কলিং মডেল র‌্যাঙ্কিং | AI BENCHY

AI BENCHY বিভাগ

দেখুন টুল কলিং এ কোন AI মডেল সবচেয়ে ভালো করে, কোনগুলো নির্ভরযোগ্য থাকে, আর সবচেয়ে বড় পার্থক্য কোথায় দেখা যায়। সাজান: সঠিক টেস্ট ↓.

দেখানো মডেল

13

গড় টুল কলিং স্কোর

8.7

সেরা মডেল

Gemini 3 Flash Preview 10.0

ব্যর্থতার কারণ

ব্যর্থতার কারণ API ত্রুটি সহ15 ব্যর্থতার কারণ অবৈধ টুল কল সহ7 ব্যর্থতার কারণ নির্দেশনা অনুসরণ করা হয়নি সহ6 ব্যর্থতার কারণ কোন উত্তর নেই সহ2 ব্যর্থতার কারণ ভুল উত্তর সহ2

র‍্যাঙ্ক	মডেল	কোম্পানি	টুল কলিং স্কোর	স্কোর	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)
#130	MiniMax M2.7 medium	Minimax	4.7	5.3	0/1	12.0s
#136	Elephant Alpha medium	Openrouter	3.0	5.1	0/1	2.83s
#137	Elephant Alpha none	Openrouter	3.0	5.1	0/1	2.79s
#138	Ling-2.6-flash none	Inclusionai	3.0	5.0	0/1	18.8s
#141	Nemotron 3 Super none	NVIDIA	4.7	4.9	0/1	16.0s
#144	GPT-5.4 Mini none	OpenAI	3.0	4.9	0/1	2.32s
#146	Laguna Xs.2 none	Poolside	3.0	4.8	0/1	1.93s
#149	Nemotron 3 Nano Omni 30b A3b Reasoning medium	NVIDIA	3.0	4.6	0/1	0ms
#153	Qwen3.6 35B A3B none	Qwen	3.0	4.6	0/1	0ms
#157	Grok 4.1 Fast none	X AI	2.8	4.4	0/1	5.51s
#159	Ling-2.6-1T none	Inclusionai	3.0	4.3	0/1	25.7s
#160	LFM2-24B-A2B none	Liquid	3.0	4.2	0/1	0ms
#162	Nemotron 3 Nano Omni 30b A3b Reasoning none	NVIDIA	3.0	4.1	0/1	0ms

←

1 10 11

টুল কলিং স্কোর অনুযায়ী শীর্ষ মডেল

টুল কলিং স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়) অনুযায়ী শীর্ষ মডেল