নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-27B vs StepFun: Step 3.7 Flash

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-02

মেট্রিক Qwen3.5-27B Qwen3.5-27B medium প্রকাশ: 2026-02-24 Step 3.7 Flash Step 3.7 Flash low প্রকাশ: 2026-05-29
স্কোর 7.9 7.4
র‍্যাঙ্ক #27 #59
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 8.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 73.3% 68.3%
অস্থির টেস্ট 3 3
মোট রান 60 60
প্রতি ফলাফলে খরচ 4.532 2.796
মোট খরচ $0.488 $0.336
ইনপুট মূল্য $0.195 / 1M $0.200 / 1M
আউটপুট মূল্য $1.560 / 1M $1.150 / 1M
মোট ইনপুট টোকেন 39,329 37,458
আউটপুট টোকেন 2,569 285,209
রিজনিং টোকেন 304,894 0
প্রতিক্রিয়া সময় (গড়) 60.09s 16.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 177.36s 124.75s
প্রতিক্রিয়া সময় (মোট) 1201.89s 321.11s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 8.7 7.9 91.7% 1 19.75s 672 569 31,505
Step 3.7 Flash 8.7 7.9 91.7% 1 4.02s 756 10,896 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 7.0 9.8 50.0% 0 123.86s 5,060 416 64,993
Step 3.7 Flash 10.0 10.0 100.0% 0 9.43s 4,794 14,569 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 14,946 483 9,991
Step 3.7 Flash 10.0 10.0 100.0% 0 7.98s 13,683 6,426 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 10.0 10.0 100.0% 0 30.26s 7,782 270 16,150
Step 3.7 Flash 7.3 5.8 83.3% 1 2.29s 7,398 2,667 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 5.3 10.0 33.3% 0 79.53s 553 43 52,368
Step 3.7 Flash 5.3 7.2 44.4% 1 43.31s 828 104,487 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 6.1 3.1 66.7% 1 101.41s 524 70 23,147
Step 3.7 Flash 3.4 9.3 0.0% 0 7.00s 525 4,604 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 699 97 11,638
Step 3.7 Flash 9.8 10.0 100.0% 0 1.58s 735 1,857 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 8.2 7.7 77.8% 1 59.60s 696 242 70,096
Step 3.7 Flash 5.5 9.9 33.3% 0 1.84s 756 3,564 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 8,193 348 1,323
Step 3.7 Flash 10.0 10.0 100.0% 0 3.25s 7,746 1,360 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 3.0 10.0 0.0% 0 85.11s 204 31 23,683
Step 3.7 Flash 3.0 10.0 0.0% 0 124.75s 237 134,779 0

দ্রুত তুলনা

তুলনার জুটি বদলান