نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.6 Flash vs StepFun: Step 3.7 Flash

خلاصہ

Qwen3.6 Flash vs Step 3.7 Flash benchmark موازنہ: Qwen3.6 Flash average score میں آگے ہے: 7.5 vs 7.0. Qwen3.6 Flash کی benchmark لاگت کم ہے: $0.288 vs $1.148. Qwen3.6 Flash تیز ہے: 19.25s vs 64.46s، pass rates 71.4% vs 63.5%.

تجویز کردہ ماڈل: Qwen3.6 Flash - It has the best score here (7.5), while costing about 4.0x less than Step 3.7 Flash.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-10

میٹرک Qwen3.6 Flash Qwen3.6 Flash medium اجرا: 2026-04-20 Step 3.7 Flash Step 3.7 Flash high اجرا: 2026-05-29
اسکور 7.5 7.0
درجہ #40 #72
اعتماد پذیری 10.0 10.0
تسلسل 8.1 8.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 71.4% 63.5%
غیر مستحکم ٹیسٹ 5 4
کل رنز 63 63
فی نتیجہ لاگت 3.030 10.434
کل لاگت $0.288 $1.148
ان پٹ قیمت $0.188 / 1M $0.200 / 1M
آؤٹ پٹ قیمت $1.125 / 1M $1.150 / 1M
کل ان پٹ ٹوکنز 42,362 38,391
آؤٹ پٹ ٹوکنز 2,995 991,355
ریزننگ ٹوکنز 245,358 0
ردِعمل کا وقت (اوسط) 19.25s 64.46s
ردِعمل کا وقت (زیادہ سے زیادہ) 122.87s 364.99s
ردِعمل کا وقت (کل) 404.20s 1353.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#40 Qwen3.6 Flash

medium
Invalid SVG
Cost
$0.008
Time
29.9s
Tokens
6,784 tok

#72 Step 3.7 Flash

high
Cost
$0.007
Time
63.6s
Tokens
6,030 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 672 624 14,024
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 5.0 5.1 44.5% 2 42.85s 7,895 495 67,967
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 14,934 483 13,839
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 7,782 270 13,155
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 771 60 24,409
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 516 140 5,445
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 699 102 7,423
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.29s 696 460 10,860
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 8,193 335 1,188
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Flash 3.0 10.0 0.0% 0 122.87s 204 26 87,048
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں