নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5-Flash vs Qwen: Qwen3.7 Plus

সারাংশ

Qwen3.5-Flash vs Qwen3.7 Plus benchmark তুলনা: Qwen3.7 Plus average score-এ এগিয়ে: 7.2 vs 6.8. Qwen3.7 Plus-এর benchmark খরচ কম: $0.023 vs $0.080. Qwen3.7 Plus দ্রুত: 2.85s vs 63.29s, pass rates 71.4% vs 47.6%.

প্রস্তাবিত মডেল: Qwen3.7 Plus - It has the best score here (7.2), while costing about 3.6x less than Qwen3.5-Flash.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Qwen3.5-Flash Qwen3.5-Flash medium প্রকাশ: 2026-02-24 Qwen3.7 Plus Qwen3.7 Plus none প্রকাশ: 2026-06-03
স্কোর 6.8 7.2
র‍্যাঙ্ক #70 #60
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.1 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.4% 47.6%
অস্থির টেস্ট 5 0
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.871 0.276
মোট খরচ $0.080 $0.023
ইনপুট মূল্য $0.065 / 1M $0.320 / 1M
আউটপুট মূল্য $0.260 / 1M $1.280 / 1M
মোট ইনপুট টোকেন 38,926 42,510
আউটপুট টোকেন 2,088 6,578
রিজনিং টোকেন 294,598 0
প্রতিক্রিয়া সময় (গড়) 63.29s 2.85s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 234.29s 29.38s
প্রতিক্রিয়া সময় (মোট) 1265.85s 59.86s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 Qwen3.5-Flash

medium
খরচ
$0.002
সময়
25.8s
টোকেন
4,294 tok

#60 Qwen3.7 Plus

none
খরচ
$0.019
সময়
213.5s
টোকেন
11,960 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 672 383 32,992
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 3.7 7.2 22.2% 1 58.87s 6,685 302 90,081
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 14,934 483 8,270
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 6,061 235 16,237
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 581 58 43,615
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 516 99 38,486
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 699 98 14,139
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 8.2 7.2 88.9% 1 27.61s 381 89 12,457
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 8,193 309 1,284
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 3.0 10.0 0.0% 0 48.98s 204 32 37,037
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0

দ্রুত তুলনা

তুলনার জুটি বদলান