نیویگیشن
AI BENCHY
Advertise here

Qwen3.7 Max vs GLM 5 (medium)

GLM 5 (medium) average score میں آگے ہے: 7.7 vs 7.4. Qwen3.7 Max کی benchmark لاگت کم ہے: $0.197 vs $0.307. Qwen3.7 Max تیز ہے: 4.52s vs 33.54s، pass rates 68.2% vs 78.8%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-25

درجہ
#67
کل آؤٹ پٹ ٹوکنز
12,446
ردِعمل کا وقت (اوسط)
4.52s
کل لاگت
$0.197
درجہ
#49
کل آؤٹ پٹ ٹوکنز
124,566
ردِعمل کا وقت (اوسط)
33.54s
کل لاگت
$0.307
تجویز کردہ ماڈل Qwen3.7 Max

Its score stays close to the best score here (7.4 vs 7.7), while costing about 1.6x less than GLM 5 (medium).

تفصیلی موازنہ

میٹرک Qwen3.7 Max Qwen3.7 Max none اجرا: 2026-05-22 GLM 5 GLM 5 medium اجرا: 2026-02-12
اسکور 7.4 7.7
درجہ #67 #49
اعتماد پذیری 9.9 10.0
تسلسل 10.0 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.2% 78.8%
غیر مستحکم ٹیسٹ 0 4
کل رنز 66 63
فی نتیجہ لاگت 1.582 1.668
کل لاگت $0.197 $0.307
ان پٹ قیمت $1.475 / 1M $0.950 / 1M
آؤٹ پٹ قیمت $4.425 / 1M $2.551 / 1M
کل ان پٹ ٹوکنز 95,983 35,224
آؤٹ پٹ ٹوکنز 12,446 21,570
ریزننگ ٹوکنز 0 102,996
ردِعمل کا وقت (اوسط) 4.52s 33.54s
ردِعمل کا وقت (زیادہ سے زیادہ) 72.30s 99.85s
ردِعمل کا وقت (کل) 99.52s 435.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Qwen3.7 Max

none
لاگت
$0.046
وقت
195.0s
ٹوکنز
12,171 tok

#49 GLM 5

medium
لاگت
$0.005
وقت
20.7s
ٹوکنز
2,068 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں