نیویگیشن
Advertise here

Qwen3.7 Max vs Grok 4.7 (high)

average score تقریباً برابر ہے: 7.4 vs 7.5. Qwen3.7 Max کی benchmark لاگت کم ہے: $0.197 vs $2.180. Qwen3.7 Max تیز ہے: 4.56s vs 113.10s، pass rates 68.2% vs 75.8%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-21

موازنہ کیے گئے ماڈلز

درجہ
#120
کل آؤٹ پٹ ٹوکنز
12,446
ردِعمل کا وقت (اوسط)
4.56s
کل لاگت
$0.197
درجہ
#110
کل آؤٹ پٹ ٹوکنز
416,086
ردِعمل کا وقت (اوسط)
113.10s
کل لاگت
$2.180
تجویز کردہ ماڈل Qwen3.7 Max

It has the best score here (7.4), while costing about 11.1x less than Grok 4.7 (high).

تفصیلی موازنہ

میٹرک Qwen3.7 Max Qwen3.7 Max none اجرا: 2026-05-22 Grok 4.7 Grok 4.7 high اجرا: 2026-09-21
اسکور 7.4 7.5
درجہ #120 #110
اعتماد پذیری 9.9 9.5
تسلسل 10.0 7.6
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.2% 75.8%
غیر مستحکم ٹیسٹ 0 7
کل رنز 66 66
فی نتیجہ لاگت 1.581 16.765
کل لاگت $0.197 $2.180
ان پٹ قیمت $1.475 / 1M $1.600 / 1M
آؤٹ پٹ قیمت $4.425 / 1M $4.800 / 1M
کل ان پٹ ٹوکنز 95,992 113,892
آؤٹ پٹ ٹوکنز 12,446 6,907
ریزننگ ٹوکنز 0 409,179
ردِعمل کا وقت (اوسط) 4.56s 113.10s
ردِعمل کا وقت (زیادہ سے زیادہ) 72.30s 573.57s
ردِعمل کا وقت (کل) 100.30s 2488.20s
پیرامیٹرز ~1T کل (~40B فعال) ~1.7T کل (~170B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Qwen3.7 Max

none
لاگت
$0.046
وقت
195.0s
ٹوکنز
12,171 tok

#110 SpaceXAI: Grok 4.7

high
لاگت
$0.110
وقت
301.3s
ٹوکنز
23,143 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں