نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.7 Plus vs StepFun: Step 3.7 Flash

خلاصہ

Qwen3.7 Plus vs Step 3.7 Flash benchmark موازنہ: Qwen3.7 Plus average score میں آگے ہے: 7.2 vs 7.1. Qwen3.7 Plus کی benchmark لاگت کم ہے: $0.023 vs $1.148. Qwen3.7 Plus تیز ہے: 2.85s vs 64.46s، pass rates 47.6% vs 63.5%.

تجویز کردہ ماڈل: Qwen3.7 Plus - It has the best score here (7.2), while costing about 52.1x less than Step 3.7 Flash.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Qwen3.7 Plus Qwen3.7 Plus none اجرا: 2026-06-03 Step 3.7 Flash Step 3.7 Flash high اجرا: 2026-05-29
اسکور 7.2 7.1
درجہ #61 #63
اعتماد پذیری 10.0 10.0
تسلسل 10.0 8.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 47.6% 63.5%
غیر مستحکم ٹیسٹ 0 4
کل رنز 63 63
فی نتیجہ لاگت 0.276 10.434
کل لاگت $0.023 $1.148
ان پٹ قیمت $0.320 / 1M $0.200 / 1M
آؤٹ پٹ قیمت $1.280 / 1M $1.150 / 1M
کل ان پٹ ٹوکنز 42,510 38,391
آؤٹ پٹ ٹوکنز 6,578 991,355
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 2.85s 64.46s
ردِعمل کا وقت (زیادہ سے زیادہ) 29.38s 364.99s
ردِعمل کا وقت (کل) 59.86s 1353.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Qwen3.7 Plus

none
Cost
$0.019
Time
213.5s
Tokens
11,960 tok

#63 Step 3.7 Flash

high
Cost
$0.007
Time
63.6s
Tokens
6,030 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں