#54

Qwen3.5 Plus 2026-02-15

Qwen প্রকাশ: 2026-02-15 পরীক্ষিত হয়েছে: 2026-04-11 01:19 qwen/qwen3.5-plus-02-15::none

(medium) (none)

সারাংশ

Qwen3.5 Plus 2026-02-15 AI BENCHY-তে 6.8 স্কোর করে এবং #54 স্থানে আছে। এর reliability প্রযোজ্য নয়, pass rate 53.7%, মোট খরচ $0.017, এবং গড় response time 2.60s.

Qwen3.5 Plus 2026-02-15 কে আলাদা করে যা: এটি কোডিং-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর সমন্বিত এর দুর্বলতম ক্ষেত্র, rank #13. এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম। একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।

স্কোর

6.8

ধারাবাহিকতা

9.3

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট খরচ (বর্তমান মূল্য)

$0.017

মোট আউটপুট টোকেন

2,461

মোট ইনপুট টোকেন

ইনপুট মূল্য

$0.260 / 1M

আউটপুট মূল্য

$1.560 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 9

প্রতি চেষ্টায় পাস রেট: 53.7%

অস্থির টেস্ট

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

2.60s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 6.65s

প্রতিক্রিয়া সময় (মোট): 31.23s

ভুল উত্তর: 9

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#54 Qwen3.5 Plus 2026-02-15

none

খরচ: $0.012
সময়: 153.2s
টোকেন: 7,787 tok

রান ইতিহাস

পরীক্ষিত হয়েছে	স্কোর	নির্ভরযোগ্যতা	মোট খরচ	তুলনা করুন
2026-06-04 13:10 নতুন টেস্ট যোগ হয়েছে	6.3	10.0	$0.016 ↓	তুলনা করুন
2026-05-21 23:45 স্যুইট পরিবর্তিত হয়েছে	6.4	10.0	$0.018	তুলনা করুন
2026-04-11 01:19 প্রথম নথিভুক্ত রান	6.8	প্রযোজ্য নয়	$0.017	বর্তমান রান

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

Qwen3.5 Plus 2026-02-15nonevsGemini 2.5 Flashnone Qwen3.5 Plus 2026-02-15nonevsGPT-5.5none Qwen3.5 Plus 2026-02-15nonevsGemini 3.1 Flash Liteminimal Qwen3.5 Plus 2026-02-15nonevsQwen3.5-35B-A3Bmedium Qwen3.5 Plus 2026-02-15nonevsGemini 3.5 Flashhigh Qwen3.5 Plus 2026-02-15nonevsGemini 3 Flash Previewmedium Qwen3.5 Plus 2026-02-15nonevsNemotron 3 Ultra 550b A55bmediumবিনামূল্যে উপলভ্য Qwen3.5 Plus 2026-02-15nonevsGPT-5.5low

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ	স্কোর	ধারাবাহিকতা
অ্যান্টি-এআই কৌশল	4.8	10.0
কোডিং	6.3	3.7
সমন্বিত	3.0	10.0
ডেটা পার্সিং ও নিষ্কাশন	10.0	10.0
ডোমেইন-নির্দিষ্ট	5.3	10.0
Sadharon Buddhimotta	4.4	3.0
নির্দেশনা অনুসরণ	10.0	10.0
ধাঁধা সমাধান	7.7	10.0
টুল কলিং	10.0	10.0

Qwen3.5 Plus 2026-02-15

Hamster playing table tennis

#54 Qwen3.5 Plus 2026-02-15

চার্ট

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর vs মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

তুলনা করা মডেল