نیویگیشن
Advertise here

GPT-6.1 Sol — low بمقابلہ medium

medium average score میں آگے ہے: 9.6 vs 9.5. low کی benchmark لاگت کم ہے: $0.275 vs $0.326. low تیز ہے: 5.36s vs 6.99s، pass rates 92.4% vs 93.9%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-29

موازنہ کیے گئے ماڈلز

درجہ
#16
کل آؤٹ پٹ ٹوکنز
11,879
ردِعمل کا وقت (اوسط)
5.36s
کل لاگت
$0.275
درجہ
#11
کل آؤٹ پٹ ٹوکنز
16,852
ردِعمل کا وقت (اوسط)
6.99s
کل لاگت
$0.326
تجویز کردہ ماڈل low

It offers the best overall trade-off: a competitive score (9.5), lower cost than GPT-6.1 Sol (medium), and balanced response time.

تفصیلی موازنہ

میٹرک GPT-6.1 Sol GPT-6.1 Sol low اجرا: 2026-09-29 GPT-6.1 Sol GPT-6.1 Sol medium اجرا: 2026-09-29
اسکور 9.5 9.6
درجہ #16 #11
اعتماد پذیری 10.0 10.0
تسلسل 9.6 9.6
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 92.4% 93.9%
غیر مستحکم ٹیسٹ 1 1
کل رنز 66 66
فی نتیجہ لاگت 1.375 1.627
کل لاگت $0.275 $0.326
ان پٹ قیمت $2.000 / 1M $2.000 / 1M
آؤٹ پٹ قیمت $10.000 / 1M $10.000 / 1M
کل ان پٹ ٹوکنز 78,018 78,368
آؤٹ پٹ ٹوکنز 4,160 4,354
ریزننگ ٹوکنز 7,719 12,498
ردِعمل کا وقت (اوسط) 5.36s 6.99s
ردِعمل کا وقت (زیادہ سے زیادہ) 29.38s 50.74s
ردِعمل کا وقت (کل) 117.89s 153.75s
پیرامیٹرز ~2T کل (~150B فعال) ~2T کل (~150B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#16 GPT-6.1 Sol

low
لاگت
$0.028
وقت
44.6s
ٹوکنز
2,881 tok

#11 GPT-6.1 Sol

medium
لاگت
$0.045
وقت
72.7s
ٹوکنز
4,581 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.74s 7,302 393 1,710

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں