Qwen3.5 Plus 2026-02-15

Qwen প্রকাশ: 2026-02-15 পরীক্ষিত হয়েছে: 2026-04-11 01:44 qwen/qwen3.5-plus-02-15::medium

(medium) (none)

সারাংশ

Qwen3.5 Plus 2026-02-15 AI BENCHY-তে 8.5 স্কোর করে এবং #8 স্থানে আছে। এর reliability প্রযোজ্য নয়, pass rate 83.3%, মোট খরচ $0.220, এবং গড় response time 46.56s.

Qwen3.5 Plus 2026-02-15 কে আলাদা করে যা: এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম।

স্কোর

8.5

ধারাবাহিকতা

9.1

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট খরচ (বর্তমান মূল্য)

$0.220

মোট আউটপুট টোকেন

114,010

মোট ইনপুট টোকেন

ইনপুট মূল্য

$0.260 / 1M

আউটপুট মূল্য

$1.560 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 4

প্রতি চেষ্টায় পাস রেট: 83.3%

অস্থির টেস্ট

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

46.56s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 120.91s

প্রতিক্রিয়া সময় (মোট): 512.20s

টাইমআউট: 2 ভুল উত্তর: 2

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#8 Qwen3.5 Plus 2026-02-15

medium

খরচ: $0.011
সময়: 125.5s
টোকেন: 7,040 tok

রান ইতিহাস

পরীক্ষিত হয়েছে	স্কোর	নির্ভরযোগ্যতা	মোট খরচ	তুলনা করুন
2026-06-04 13:17 নতুন টেস্ট যোগ হয়েছে	7.9	8.9	$0.310 ↓	তুলনা করুন
2026-05-21 23:53 স্যুইট পরিবর্তিত হয়েছে	8.1	10.0	$0.317	তুলনা করুন
2026-04-11 01:44 প্রথম নথিভুক্ত রান	8.5	প্রযোজ্য নয়	$0.220	বর্তমান রান

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর vs মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

Qwen3.5 Plus 2026-02-15mediumvsNemotron 3 Ultra 550b A55bmediumবিনামূল্যে উপলভ্য Qwen3.5 Plus 2026-02-15mediumvsQwen3.7 Plusmedium Qwen3.5 Plus 2026-02-15mediumvsQwen3.5-27Bmedium Qwen3.5 Plus 2026-02-15mediumvsGemini 2.5 Flashmedium Qwen3.5 Plus 2026-02-15mediumvsClaude Sonnet 5medium Qwen3.5 Plus 2026-02-15mediumvsGemini 3.5 Flashhigh Qwen3.5 Plus 2026-02-15mediumvsGemini 3 Flash Previewmedium Qwen3.5 Plus 2026-02-15mediumvsGPT-5.5low

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ	স্কোর	ধারাবাহিকতা
অ্যান্টি-এআই কৌশল	8.2	7.9
কোডিং	10.0	10.0
সমন্বিত	10.0	10.0
ডেটা পার্সিং ও নিষ্কাশন	10.0	10.0
ডোমেইন-নির্দিষ্ট	5.3	10.0
Sadharon Buddhimotta	4.7	1.6
নির্দেশনা অনুসরণ	10.0	10.0
ধাঁধা সমাধান	10.0	10.0
টুল কলিং	10.0	10.0

Qwen3.5 Plus 2026-02-15

Hamster playing table tennis

#8 Qwen3.5 Plus 2026-02-15

চার্ট

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর vs মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

তুলনা করা মডেল