AI BENCHY
Advertise here
#21

Qwen3.6 Plus

Qwen প্রকাশ: 2026-04-20 পরীক্ষিত হয়েছে: 2026-04-11 01:44 qwen/qwen3.6-plus::medium
~397B মোট (~17B সক্রিয়)MoEবন্ধ উৎসআনুমানিক

সারাংশ

Qwen3.6 Plus AI BENCHY-তে 8.1 স্কোর করে এবং #21 স্থানে আছে। এর reliability প্রযোজ্য নয়, pass rate 74.1%, মোট খরচ $0.000, এবং গড় response time 15.27s.

Qwen3.6 Plus কে আলাদা করে যা: এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম।

পরিচয় নোট

Qwen3.6 Plus Preview ছিল Qwen3.6 Plus-এর প্রিভিউ সংস্করণ।

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

আনুমানিক
প্যারামিটার
~397B মোট (~17B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

9.5

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

85,545

মোট ইনপুট টোকেন

0

ইনপুট মূল্য

$0.325 / 1M

আউটপুট মূল্য

$1.950 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 5

প্রতি চেষ্টায় পাস রেট: 74.1%

অস্থির টেস্ট

1

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

15.27s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 43.55s

প্রতিক্রিয়া সময় (মোট): 259.55s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Qwen3.6 Plus

medium
খরচ
$0.024
সময়
219.0s
টোকেন
12,235 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-08-14 01:53 পুনরায় পরীক্ষা 7.8 10.0 $0.418 তুলনা করুন
2026-07-16 21:57 নতুন টেস্ট যোগ হয়েছে 7.8 10.0 $0.405 তুলনা করুন
2026-06-04 13:30 নতুন টেস্ট যোগ হয়েছে 7.9 10.0 $0.294 তুলনা করুন
2026-05-22 00:01 পুনরায় পরীক্ষা 7.8 10.0 $0.082 তুলনা করুন
2026-04-11 01:44 প্রথম নথিভুক্ত রান 8.1 প্রযোজ্য নয় $0.000 বর্তমান রান

রান তুলনা

রানবেঞ্চমার্ক কভারেজস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-11 01:44 · প্রথম নথিভুক্ত রান54/54 প্রচেষ্টা8.19.5প্রযোজ্য নয়13/18185,5450$0.00015.27s
2026-07-16 21:57 · নতুন টেস্ট যোগ হয়েছে66/66 প্রচেষ্টা7.89.310.015/222191,23797,689$0.40543.12s
পার্থক্য+0.3+0.2-2-1-105692-97689-$0.405-27853ms

বেঞ্চমার্ক কভারেজ আলাদা: 54/54 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 66/66 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 10.0 10.0
কোডিং 3.0 10.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 2.9 7.2
Sadharon Buddhimotta 5.1 10.0
নির্দেশনা অনুসরণ 10.0 10.0
ধাঁধা সমাধান 10.0 10.0
টুল কলিং 10.0 10.0

তুলনা করা মডেল