#88

Qwen3.5 Plus 2026-02-15

Qwen প্রকাশ: 2026-02-15 পরীক্ষিত হয়েছে: 2026-05-21 23:45 qwen/qwen3.5-plus-02-15::none

(medium) (none)

সারাংশ

Qwen3.5 Plus 2026-02-15 AI BENCHY-তে 6.4 স্কোর করে এবং #88 স্থানে আছে। এর reliability 10.0, pass rate 48.3%, মোট খরচ $0.018, এবং গড় response time 2.41s.

Qwen3.5 Plus 2026-02-15 কে আলাদা করে যা: এটি ডোমেইন-নির্দিষ্ট-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #3; আর অ্যান্টি-এআই কৌশল এর দুর্বলতম ক্ষেত্র, rank #12.

স্কোর

6.4

ধারাবাহিকতা

9.3

নির্ভরযোগ্যতা

10.0

মোট খরচ (বর্তমান মূল্য)

$0.018

মোট আউটপুট টোকেন

2,496

মোট ইনপুট টোকেন

ইনপুট মূল্য

$0.260 / 1M

আউটপুট মূল্য

$1.560 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 11

প্রতি চেষ্টায় পাস রেট: 48.3%

অস্থির টেস্ট

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

2.41s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 6.65s

প্রতিক্রিয়া সময় (মোট): 33.80s

ভুল উত্তর: 11

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#88 Qwen3.5 Plus 2026-02-15

none

খরচ: $0.012
সময়: 153.2s
টোকেন: 7,787 tok

রান ইতিহাস

পরীক্ষিত হয়েছে	স্কোর	নির্ভরযোগ্যতা	মোট খরচ	তুলনা করুন
2026-06-04 13:10 নতুন টেস্ট যোগ হয়েছে	6.3	10.0	$0.016 ↓	তুলনা করুন
2026-05-21 23:45 স্যুইট পরিবর্তিত হয়েছে	6.4	10.0	$0.018	বর্তমান রান
2026-04-11 01:19 প্রথম নথিভুক্ত রান	6.8	প্রযোজ্য নয়	$0.017	তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

Qwen3.5 Plus 2026-02-15nonevsGemini 2.5 Flashnone Qwen3.5 Plus 2026-02-15nonevsGPT-5.5none Qwen3.5 Plus 2026-02-15nonevsGemini 3.1 Flash Liteminimal Qwen3.5 Plus 2026-02-15nonevsQwen3.5-35B-A3Bmedium Qwen3.5 Plus 2026-02-15nonevsGemini 3.5 Flashhigh Qwen3.5 Plus 2026-02-15nonevsGemini 3 Flash Previewmedium Qwen3.5 Plus 2026-02-15nonevsNemotron 3 Ultra 550b A55bmediumবিনামূল্যে উপলভ্য Qwen3.5 Plus 2026-02-15nonevsGPT-5.5low

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ	স্কোর	ধারাবাহিকতা
অ্যান্টি-এআই কৌশল	4.8	10.0
কোডিং	4.9	6.9
সমন্বিত	3.0	10.0
ডেটা পার্সিং ও নিষ্কাশন	10.0	10.0
ডোমেইন-নির্দিষ্ট	5.3	10.0
Sadharon Buddhimotta	4.4	3.0
নির্দেশনা অনুসরণ	10.0	10.0
ধাঁধা সমাধান	7.7	10.0
টুল কলিং	10.0	10.0
সাধারণ জ্ঞান	3.0	10.0

Qwen3.5 Plus 2026-02-15

Hamster playing table tennis

#88 Qwen3.5 Plus 2026-02-15

চার্ট

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর vs মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

তুলনা করা মডেল