नेव्हिगेशन
Advertise here

GPT-6.1 Sol — high वि medium

average score जवळपास समान आहे: 9.6 vs 9.6. medium चा benchmark खर्च कमी आहे: $0.326 vs $0.542. medium वेगवान आहे: 6.99s vs 13.68s, pass rates 93.9% vs 93.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-29

तुलना केलेली मॉडेल्स

क्रमांक
#12
एकूण आउटपुट टोकन्स
38,258
प्रतिसाद वेळ (सरासरी)
13.68s
एकूण खर्च
$0.542
क्रमांक
#11
एकूण आउटपुट टोकन्स
16,852
प्रतिसाद वेळ (सरासरी)
6.99s
एकूण खर्च
$0.326
शिफारस केलेले मॉडेल medium

It has the best score here (9.6), while costing about 1.7x less than GPT-6.1 Sol (high).

तपशीलवार तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol high प्रकाशन: 2026-09-29 GPT-6.1 Sol GPT-6.1 Sol medium प्रकाशन: 2026-09-29
स्कोअर 9.6 9.6
क्रमांक #12 #11
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 93.9% 93.9%
अस्थिर चाचण्या 1 1
एकूण रन 66 66
प्रति निकाल खर्च 2.708 1.627
एकूण खर्च $0.542 $0.326
इनपुट किंमत $2.000 / 1M $2.000 / 1M
आउटपुट किंमत $10.000 / 1M $10.000 / 1M
एकूण इनपुट टोकन्स 79,492 78,368
आउटपुट टोकन्स 4,954 4,354
रिझनिंग टोकन्स 33,304 12,498
प्रतिसाद वेळ (सरासरी) 13.68s 6.99s
प्रतिसाद वेळ (कमाल) 139.76s 50.74s
प्रतिसाद वेळ (एकूण) 301.03s 153.75s
पॅरामीटर्स ~2T एकूण (~150B सक्रिय) ~2T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 GPT-6.1 Sol

high
खर्च
$0.079
वेळ
149.5s
टोकन्स
7,920 tok

#11 GPT-6.1 Sol

medium
खर्च
$0.045
वेळ
72.7s
टोकन्स
4,581 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6.1 Sol 10.0 10.0 100.0% 0 5.18s 7,302 390 2,215
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.74s 7,302 393 1,710

झटपट तुलना

तुलना जोडी बदला