نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.6 Max Preview vs StepFun: Step 3.5 Flash

خلاصہ

Qwen3.6 Max Preview vs Step 3.5 Flash benchmark موازنہ: Step 3.5 Flash average score میں آگے ہے: 6.6 vs 6.0. Step 3.5 Flash کی benchmark لاگت کم ہے: $0.070 vs $0.075. Qwen3.6 Max Preview تیز ہے: 3.30s vs 72.53s، pass rates 58.7% vs 54.0%.

تجویز کردہ ماڈل: Qwen3.6 Max Preview - Its score stays close to the best score here (6.0 vs 6.6), while responding about 21.9x faster than Step 3.5 Flash.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک Qwen3.6 Max Preview Qwen3.6 Max Preview none اجرا: 2026-04-20 Step 3.5 Flash Step 3.5 Flash medium اجرا: 2026-02-01
اسکور 6.0 6.6
درجہ #100 #80
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.9
درست ٹیسٹس
فی کوشش کامیابی کی شرح 58.7% 54.0%
غیر مستحکم ٹیسٹ 2 1
کل رنز 63 60
فی نتیجہ لاگت 0.824 0.198
کل لاگت $0.075 $0.070
ان پٹ قیمت $1.040 / 1M $0.090 / 1M
آؤٹ پٹ قیمت $6.240 / 1M $0.300 / 1M
کل ان پٹ ٹوکنز 42,509 34,431
آؤٹ پٹ ٹوکنز 4,779 91,587
ریزننگ ٹوکنز 0 195,973
ردِعمل کا وقت (اوسط) 3.30s 72.53s
ردِعمل کا وقت (زیادہ سے زیادہ) 20.51s 453.94s
ردِعمل کا وقت (کل) 69.40s 1015.47s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#100 Qwen3.6 Max Preview

none
لاگت
$0.025
وقت
83.9s
ٹوکنز
4,066 tok

#80 Step 3.5 Flash

medium
لاگت
$0.008
وقت
277.1s
ٹوکنز
23,695 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 5.2 7.9 41.7% 1 2.63s 696 513 0
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 694 20,391 24,176
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
Step 3.5 Flash 2.4 5.2 0.0% 0 258.38s 2,211 13,207 22,429
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 20.51s 14,949 2,842 0
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 13,638 1,176 12,984
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.87s 7,794 243 0
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 7,368 600 13,886
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 7.7 10.0 66.7% 0 1.22s 789 18 0
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 673 45,350 90,436
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 4.3 10.0 0.0% 0 1.62s 522 76 0
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 509 240 3,506
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 9.8 10.0 100.0% 0 1.40s 711 69 0
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 705 2,364 3,521
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.65s 714 321 0
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 711 5,630 10,861
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 5.27s 8,211 222 0
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 7,701 275 3,802
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 1.97s 210 19 0
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 221 2,354 10,372

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں