نیویگیشن
Advertise here

GPT-6 Luna (high) vs Qwen3.8 2.4T A95B (low)

GPT-6 Luna (high) average score میں آگے ہے: 8.3 vs 8.1. GPT-6 Luna (high) کی benchmark لاگت کم ہے: $0.054 vs $2.672. GPT-6 Luna (high) تیز ہے: 17.53s vs 118.97s، pass rates 75.8% vs 72.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-23

موازنہ کیے گئے ماڈلز

درجہ
#73
کل آؤٹ پٹ ٹوکنز
91,405
ردِعمل کا وقت (اوسط)
17.53s
کل لاگت
$0.054
درجہ
#78
کل آؤٹ پٹ ٹوکنز
495,541
ردِعمل کا وقت (اوسط)
118.97s
کل لاگت
$2.672
تجویز کردہ ماڈل GPT-6 Luna (high)

It has the best score here (8.3), while costing about 49.7x less than Qwen3.8 2.4T A95B (low).

تفصیلی موازنہ

میٹرک GPT-6 Luna GPT-6 Luna high اجرا: 2026-09-23 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low اجرا: 2026-08-12
اسکور 8.3 8.1
درجہ #73 #78
اعتماد پذیری 10.0 9.4
تسلسل 9.0 9.2
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 75.8% 72.7%
غیر مستحکم ٹیسٹ 3 2
کل رنز 66 66
فی نتیجہ لاگت 0.359 17.812
کل لاگت $0.054 $2.672
ان پٹ قیمت $0.100 / 1M $2.000 / 1M
آؤٹ پٹ قیمت $0.500 / 1M $6.000 / 1M
کل ان پٹ ٹوکنز 80,441 113,279
آؤٹ پٹ ٹوکنز 4,761 121,045
ریزننگ ٹوکنز 86,644 374,496
ردِعمل کا وقت (اوسط) 17.53s 118.97s
ردِعمل کا وقت (زیادہ سے زیادہ) 106.93s 534.21s
ردِعمل کا وقت (کل) 385.74s 2617.41s
پیرامیٹرز ~400B کل (~17B فعال) 2.4T کل (95B فعال)
دستیابی بند ماخذ وزن دستیاب

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#73 GPT-6 Luna

high
لاگت
$0.003
وقت
49.2s
ٹوکنز
5,231 tok

#78 Qwen3.8 2.4T A95B

low
لاگت
$0.100
وقت
193.2s
ٹوکنز
16,767 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Qwen3.8 2.4T A95B 7.8 9.3 66.7% 0 172.53s 6,716 21,405 57,399

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں