نیویگیشن
Advertise here

Qwen3.7 Max vs Grok 4.6 (medium)

Qwen3.7 Max average score میں آگے ہے: 7.9 vs 7.8. Qwen3.7 Max کی benchmark لاگت کم ہے: $0.492 vs $2.270. Qwen3.7 Max تیز ہے: 7.85s vs 74.77s، pass rates 69.6% vs 78.3%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#100
کل آؤٹ پٹ ٹوکنز
20,670
ردِعمل کا وقت (اوسط)
7.85s
کل لاگت
$0.492
درجہ
#107
کل آؤٹ پٹ ٹوکنز
266,197
ردِعمل کا وقت (اوسط)
74.77s
کل لاگت
$2.270
تجویز کردہ ماڈل Qwen3.7 Max

It has the best score here (7.9), while costing about 4.6x less than Grok 4.6 (medium).

تفصیلی موازنہ

میٹرک Qwen3.7 Max Qwen3.7 Max none اجرا: 2026-05-22 Grok 4.6 Grok 4.6 medium اجرا: 2026-08-12
اسکور 7.9 7.8
درجہ #100 #107
اعتماد پذیری 9.9 10.0
تسلسل 10.0 8.7
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 69.6% 78.3%
غیر مستحکم ٹیسٹ 0 4
کل رنز 69 69
فی نتیجہ لاگت 3.070 14.187
کل لاگت $0.492 $2.270
ان پٹ قیمت $1.475 / 1M $2.000 / 1M
آؤٹ پٹ قیمت $4.425 / 1M $6.000 / 1M
کل ان پٹ ٹوکنز 243,553 336,351
آؤٹ پٹ ٹوکنز 20,670 6,180
ریزننگ ٹوکنز 0 260,017
ردِعمل کا وقت (اوسط) 7.85s 74.77s
ردِعمل کا وقت (زیادہ سے زیادہ) 80.34s 514.35s
ردِعمل کا وقت (کل) 180.65s 1719.73s
پیرامیٹرز ~1T کل (~40B فعال) ~1.7T کل (~170B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#100 Qwen3.7 Max

none
لاگت
$0.046
وقت
195.0s
ٹوکنز
12,171 tok

#107 SpaceXAI: Grok 4.6

medium
لاگت
$0.028
وقت
72.1s
ٹوکنز
4,771 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں