نیویگیشن
Advertise here

Qwen3.7 Plus (medium) vs Grok 4.5 (high)

average score تقریباً برابر ہے: 8.3 vs 8.2. Qwen3.7 Plus (medium) کی benchmark لاگت کم ہے: $0.432 vs $2.571. Qwen3.7 Plus (medium) تیز ہے: 59.73s vs 72.50s، pass rates 76.8% vs 82.6%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#81
کل آؤٹ پٹ ٹوکنز
215,560
ردِعمل کا وقت (اوسط)
59.73s
کل لاگت
$0.432
درجہ
#82
کل آؤٹ پٹ ٹوکنز
333,632
ردِعمل کا وقت (اوسط)
72.50s
کل لاگت
$2.571
تجویز کردہ ماڈل Qwen3.7 Plus (medium)

It has the best score here (8.3), while costing about 6.0x less than Grok 4.5 (high).

تفصیلی موازنہ

میٹرک Qwen3.7 Plus Qwen3.7 Plus medium اجرا: 2026-06-03 Grok 4.5 Grok 4.5 high اجرا: 2026-07-08
اسکور 8.3 8.2
درجہ #81 #82
اعتماد پذیری 10.0 10.0
تسلسل 8.9 8.9
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 76.8% 82.6%
غیر مستحکم ٹیسٹ 3 3
کل رنز 69 69
فی نتیجہ لاگت 2.697 15.123
کل لاگت $0.432 $2.571
ان پٹ قیمت $0.320 / 1M $2.000 / 1M
آؤٹ پٹ قیمت $1.280 / 1M $6.000 / 1M
کل ان پٹ ٹوکنز 350,546 342,124
آؤٹ پٹ ٹوکنز 8,576 7,135
ریزننگ ٹوکنز 206,984 326,497
ردِعمل کا وقت (اوسط) 59.73s 72.50s
ردِعمل کا وقت (زیادہ سے زیادہ) 315.30s 676.83s
ردِعمل کا وقت (کل) 1373.73s 1667.51s
پیرامیٹرز ~397B کل (~17B فعال) ~1.7T کل (~170B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 Qwen3.7 Plus

medium
لاگت
$0.018
وقت
193.2s
ٹوکنز
10,821 tok

#82 SpaceXAI: Grok 4.5

high
لاگت
$0.015
وقت
29.7s
ٹوکنز
2,737 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں