नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol vs Grok 4.3 (medium)

average score जवळपास समान आहे: 7.0 vs 7.0. GPT-5.6 Sol चा benchmark खर्च कमी आहे: $0.524 vs $0.741. GPT-5.6 Sol वेगवान आहे: 2.17s vs 44.21s, pass rates 63.6% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#115
एकूण आउटपुट टोकन्स
4,357
प्रतिसाद वेळ (सरासरी)
2.17s
एकूण खर्च
$0.524
क्रमांक
#114
एकूण आउटपुट टोकन्स
225,904
प्रतिसाद वेळ (सरासरी)
44.21s
एकूण खर्च
$0.741
शिफारस केलेले मॉडेल GPT-5.6 Sol

It has the best score here (7.0), while responding about 20.4x faster than Grok 4.3 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none प्रकाशन: 2026-07-09 Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01
स्कोअर 7.0 7.0
क्रमांक #115 #114
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 8.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 66.7%
अस्थिर चाचण्या 3 5
एकूण रन 66 66
प्रति निकाल खर्च 4.365 6.168
एकूण खर्च $0.524 $0.741
इनपुट किंमत $5.000 / 1M $1.250 / 1M
आउटपुट किंमत $30.000 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 78,602 140,244
आउटपुट टोकन्स 4,357 13,739
रिझनिंग टोकन्स 0 212,165
प्रतिसाद वेळ (सरासरी) 2.17s 44.21s
प्रतिसाद वेळ (कमाल) 12.81s 216.69s
प्रतिसाद वेळ (एकूण) 47.66s 972.64s
पॅरामीटर्स ~2T एकूण (~150B सक्रिय) ~1.5T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 GPT-5.6 Sol

none
खर्च
$0.116
वेळ
78.7s
टोकन्स
3,944 tok

#114 SpaceXAI: Grok 4.3

medium
खर्च
$0.009
वेळ
19.0s
टोकन्स
3,661 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

झटपट तुलना

तुलना जोडी बदला