نیویگیشن
Advertise here

GPT-6 Luna (high) vs Qwen3.7 Plus

Qwen3.7 Plus average score میں آگے ہے: 7.8 vs 7.7. GPT-6 Luna (high) کی benchmark لاگت کم ہے: $0.074 vs $0.184. Qwen3.7 Plus تیز ہے: 17.80s vs 20.37s، pass rates 73.9% vs 56.5%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#111
کل آؤٹ پٹ ٹوکنز
101,587
ردِعمل کا وقت (اوسط)
20.37s
کل لاگت
$0.074
درجہ
#108
کل آؤٹ پٹ ٹوکنز
76,261
ردِعمل کا وقت (اوسط)
17.80s
کل لاگت
$0.184
تجویز کردہ ماڈل GPT-6 Luna (high)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 2.5x less than Qwen3.7 Plus.

تفصیلی موازنہ

میٹرک GPT-6 Luna GPT-6 Luna high اجرا: 2026-09-23 Qwen3.7 Plus Qwen3.7 Plus none اجرا: 2026-06-03
اسکور 7.7 7.8
درجہ #111 #108
اعتماد پذیری 10.0 10.0
تسلسل 8.7 10.0
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 73.9% 56.5%
غیر مستحکم ٹیسٹ 4 0
کل رنز 69 69
فی نتیجہ لاگت 0.492 1.410
کل لاگت $0.074 $0.184
ان پٹ قیمت $0.100 / 1M $0.320 / 1M
آؤٹ پٹ قیمت $0.500 / 1M $1.280 / 1M
کل ان پٹ ٹوکنز 229,986 250,495
آؤٹ پٹ ٹوکنز 6,037 76,261
ریزننگ ٹوکنز 95,550 0
ردِعمل کا وقت (اوسط) 20.37s 17.80s
ردِعمل کا وقت (زیادہ سے زیادہ) 106.93s 206.03s
ردِعمل کا وقت (کل) 468.52s 409.51s
پیرامیٹرز ~400B کل (~17B فعال) ~397B کل (~17B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 GPT-6 Luna

high
لاگت
$0.003
وقت
49.2s
ٹوکنز
5,231 tok

#108 Qwen3.7 Plus

none
لاگت
$0.019
وقت
213.5s
ٹوکنز
11,960 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں