নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.6 27B vs StepFun: Step 3.7 Flash

সারাংশ

Qwen3.6 27B vs Step 3.7 Flash benchmark তুলনা: Step 3.7 Flash average score-এ এগিয়ে: 7.3 vs 6.8. Qwen3.6 27B-এর benchmark খরচ কম: $0.336 vs $0.341. Step 3.7 Flash দ্রুত: 15.74s vs 59.71s, pass rates 60.3% vs 68.3%.

প্রস্তাবিত মডেল: Step 3.7 Flash - It has the best score here (7.3), while responding about 3.8x faster than Qwen3.6 27B.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-10

মেট্রিক Qwen3.6 27B Qwen3.6 27B medium প্রকাশ: 2026-04-20 Step 3.7 Flash Step 3.7 Flash low প্রকাশ: 2026-05-29
স্কোর 6.8 7.3
র‍্যাঙ্ক #79 #58
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.2 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 60.3% 68.3%
অস্থির টেস্ট 5 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 3.361 2.840
মোট খরচ $0.336 $0.341
ইনপুট মূল্য $0.290 / 1M $0.200 / 1M
আউটপুট মূল্য $2.400 / 1M $1.150 / 1M
মোট ইনপুট টোকেন 39,376 40,101
আউটপুট টোকেন 16,189 289,325
রিজনিং টোকেন 122,521 0
প্রতিক্রিয়া সময় (গড়) 59.71s 15.74s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 168.22s 124.75s
প্রতিক্রিয়া সময় (মোট) 1254.01s 330.63s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 Qwen3.6 27B

medium
Cost
$0.009
Time
39.6s
Tokens
3,090 tok

#58 Step 3.7 Flash

low
Invalid SVG
Cost
$0.004
Time
25.3s
Tokens
3,072 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 8.3 10.0 75.0% 0 12.62s 453 582 4,311
Step 3.7 Flash 8.7 7.9 91.7% 1 4.02s 756 10,896 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367
Step 3.7 Flash 8.2 7.2 88.9% 1 9.46s 7,437 18,685 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 7.0 3.7 66.7% 1 83.07s 15,104 2,088 14,689
Step 3.7 Flash 10.0 10.0 100.0% 0 7.98s 13,683 6,426 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 3.5 1.4 50.0% 2 37.30s 7,778 568 9,404
Step 3.7 Flash 7.3 5.8 83.3% 1 2.29s 7,398 2,667 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 2.9 7.2 11.1% 1 73.38s 662 3,510 20,352
Step 3.7 Flash 5.3 7.2 44.4% 1 43.31s 828 104,487 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 6.5 3.4 66.7% 1 39.53s 516 81 3,045
Step 3.7 Flash 3.4 9.3 0.0% 0 7.00s 525 4,604 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 10.0 10.0 100.0% 0 37.96s 699 346 6,548
Step 3.7 Flash 9.8 10.0 100.0% 0 1.58s 735 1,857 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 7.7 10.0 66.7% 0 61.14s 696 255 12,044
Step 3.7 Flash 5.5 9.9 33.3% 0 1.84s 756 3,564 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 10.0 10.0 100.0% 0 16.88s 8,213 390 2,954
Step 3.7 Flash 10.0 10.0 100.0% 0 3.25s 7,746 1,360 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.6 27B 3.0 10.0 0.0% 0 80.99s 204 401 5,807
Step 3.7 Flash 3.0 10.0 0.0% 0 124.75s 237 134,779 0

দ্রুত তুলনা

তুলনার জুটি বদলান