नेव्हिगेशन
Advertise here

GPT-5.6 Sol vs Grok 4.3 (medium)

average score जवळपास समान आहे: 7.0 vs 7.0. GPT-5.6 Sol चा benchmark खर्च कमी आहे: $0.201 vs $0.741. GPT-5.6 Sol वेगवान आहे: 2.17s vs 44.21s, pass rates 63.6% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-29

तुलना केलेली मॉडेल्स

क्रमांक
#168
एकूण आउटपुट टोकन्स
4,357
प्रतिसाद वेळ (सरासरी)
2.17s
एकूण खर्च
$0.201
क्रमांक
#167
एकूण आउटपुट टोकन्स
225,904
प्रतिसाद वेळ (सरासरी)
44.21s
एकूण खर्च
$0.741
शिफारस केलेले मॉडेल GPT-5.6 Sol

It has the best score here (7.0), while costing about 3.7x less than Grok 4.3 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none प्रकाशन: 2026-07-09 Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01
स्कोअर 7.0 7.0
क्रमांक #168 #167
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 8.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 66.7%
अस्थिर चाचण्या 3 5
एकूण रन 66 66
प्रति निकाल खर्च 4.365 6.168
एकूण खर्च $0.201 $0.741
इनपुट किंमत $2.000 / 1M $1.250 / 1M
आउटपुट किंमत $10.000 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 78,602 140,244
आउटपुट टोकन्स 4,357 13,739
रिझनिंग टोकन्स 0 212,165
प्रतिसाद वेळ (सरासरी) 2.17s 44.21s
प्रतिसाद वेळ (कमाल) 12.81s 216.69s
प्रतिसाद वेळ (एकूण) 47.66s 972.64s
पॅरामीटर्स ~2T एकूण (~150B सक्रिय) ~1.5T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#168 GPT-5.6 Sol

none
खर्च
$0.116
वेळ
78.7s
टोकन्स
3,944 tok

#167 SpaceXAI: Grok 4.3

medium
खर्च
$0.009
वेळ
19.0s
टोकन्स
3,661 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

झटपट तुलना

तुलना जोडी बदला