नेव्हिगेशन
Advertise here

GPT-5.6 Sol vs Grok 4.20 (medium)

average score जवळपास समान आहे: 7.0 vs 7.0. GPT-5.6 Sol चा benchmark खर्च कमी आहे: $0.201 vs $0.805. GPT-5.6 Sol वेगवान आहे: 2.17s vs 32.56s, pass rates 63.6% vs 60.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-10

तुलना केलेली मॉडेल्स

क्रमांक
#140
एकूण आउटपुट टोकन्स
4,357
प्रतिसाद वेळ (सरासरी)
2.17s
एकूण खर्च
$0.201
क्रमांक
#145
एकूण आउटपुट टोकन्स
270,259
प्रतिसाद वेळ (सरासरी)
32.56s
एकूण खर्च
$0.805
शिफारस केलेले मॉडेल GPT-5.6 Sol

It has the best score here (7.0), while costing about 4.0x less than Grok 4.20 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none प्रकाशन: 2026-07-09 Grok 4.20 Grok 4.20 medium प्रकाशन: 2026-03-31
स्कोअर 7.0 7.0
क्रमांक #140 #145
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 8.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 60.6%
अस्थिर चाचण्या 3 5
एकूण रन 66 66
प्रति निकाल खर्च 4.365 10.365
एकूण खर्च $0.201 $0.805
इनपुट किंमत $2.000 / 1M $1.250 / 1M
आउटपुट किंमत $10.000 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 78,602 102,986
आउटपुट टोकन्स 4,357 5,860
रिझनिंग टोकन्स 0 264,399
प्रतिसाद वेळ (सरासरी) 2.17s 32.56s
प्रतिसाद वेळ (कमाल) 12.81s 199.66s
प्रतिसाद वेळ (एकूण) 47.66s 716.36s
पॅरामीटर्स ~2T एकूण (~150B सक्रिय) ~1T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#140 GPT-5.6 Sol

none
खर्च
$0.116
वेळ
78.7s
टोकन्स
3,944 tok

#145 SpaceXAI: Grok 4.20

medium
खर्च
$0.041
वेळ
110.3s
टोकन्स
16,336 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

झटपट तुलना

तुलना जोडी बदला