AI BENCHY
Advertise here
#54

Qwen3.5 Plus 2026-02-15

Qwen প্রকাশ: 2026-02-15 পরীক্ষিত হয়েছে: 2026-04-11 01:19 qwen/qwen3.5-plus-02-15::none
(medium) (none)

সারাংশ

Qwen3.5 Plus 2026-02-15 AI BENCHY-তে 6.8 স্কোর করে এবং #54 স্থানে আছে। এর reliability প্রযোজ্য নয়, pass rate 53.7%, মোট খরচ $0.017, এবং গড় response time 2.60s.

Qwen3.5 Plus 2026-02-15 কে আলাদা করে যা: এটি কোডিং-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর সমন্বিত এর দুর্বলতম ক্ষেত্র, rank #13. এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম। একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।

ধারাবাহিকতা

9.3

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

2,461

মোট ইনপুট টোকেন

0

ইনপুট মূল্য

$0.260 / 1M

আউটপুট মূল্য

$1.560 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 9

প্রতি চেষ্টায় পাস রেট: 53.7%

অস্থির টেস্ট

2

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

2.60s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 6.65s

প্রতিক্রিয়া সময় (মোট): 31.23s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#54 Qwen3.5 Plus 2026-02-15

none
খরচ
$0.012
সময়
153.2s
টোকেন
7,787 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-06-04 13:10 নতুন টেস্ট যোগ হয়েছে 6.3 10.0 $0.016 তুলনা করুন
2026-05-21 23:45 স্যুইট পরিবর্তিত হয়েছে 6.4 10.0 $0.018 তুলনা করুন
2026-04-11 01:19 প্রথম নথিভুক্ত রান 6.8 প্রযোজ্য নয় $0.017 বর্তমান রান

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 4.8 10.0
কোডিং 6.3 3.7
সমন্বিত 3.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 10.0
Sadharon Buddhimotta 4.4 3.0
নির্দেশনা অনুসরণ 10.0 10.0
ধাঁধা সমাধান 7.7 10.0
টুল কলিং 10.0 10.0

তুলনা করা মডেল