নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5-122B-A10B vs StepFun: Step 3.5 Flash

সারাংশ

Qwen3.5-122B-A10B vs Step 3.5 Flash benchmark তুলনা: Step 3.5 Flash average score-এ এগিয়ে: 6.6 vs 5.3. Qwen3.5-122B-A10B-এর benchmark খরচ কম: $0.020 vs $0.070. Qwen3.5-122B-A10B দ্রুত: 3.41s vs 72.53s, pass rates 31.8% vs 54.0%.

প্রস্তাবিত মডেল: Qwen3.5-122B-A10B - It offers the best overall trade-off: a competitive score (5.3), lower cost than Step 3.5 Flash, and balanced response time.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Qwen3.5-122B-A10B Qwen3.5-122B-A10B none প্রকাশ: 2026-02-24 Step 3.5 Flash Step 3.5 Flash medium প্রকাশ: 2026-02-01
স্কোর 5.3 6.6
র‍্যাঙ্ক #125 #80
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 31.8% 54.0%
অস্থির টেস্ট 1 1
মোট রান 63 60
প্রতি ফলাফলে খরচ 0.393 0.198
মোট খরচ $0.020 $0.070
ইনপুট মূল্য $0.260 / 1M $0.090 / 1M
আউটপুট মূল্য $2.080 / 1M $0.300 / 1M
মোট ইনপুট টোকেন 47,735 34,431
আউটপুট টোকেন 3,383 91,587
রিজনিং টোকেন 0 195,973
প্রতিক্রিয়া সময় (গড়) 3.41s 72.53s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 46.00s 453.94s
প্রতিক্রিয়া সময় (মোট) 71.59s 1015.47s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Qwen3.5-122B-A10B

none
খরচ
$0.016
সময়
44.5s
টোকেন
6,431 tok

#80 Step 3.5 Flash

medium
খরচ
$0.008
সময়
277.1s
টোকেন
23,695 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 696 312 0
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 694 20,391 24,176
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0
Step 3.5 Flash 2.4 5.2 0.0% 0 258.38s 2,211 13,207 22,429
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 20,175 1,137 0
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 13,638 1,176 12,984
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 7,794 243 0
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 7,368 600 13,886
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 789 15 0
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 673 45,350 90,436
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 522 66 0
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 509 240 3,506
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 6.3 10.0 50.0% 0 513ms 711 69 0
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 705 2,364 3,521
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 3.8 10.0 0.0% 0 1.00s 714 575 0
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 711 5,630 10,861
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 8,211 264 0
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 7,701 275 3,802
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 295ms 210 9 0
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 221 2,354 10,372

দ্রুত তুলনা

তুলনার জুটি বদলান