नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.5 vs Grok 4.20 (medium)

average score जवळपास समान आहे: 7.0 vs 7.0. GPT-5.5 चा benchmark खर्च कमी आहे: $0.544 vs $0.805. GPT-5.5 वेगवान आहे: 2.35s vs 32.56s, pass rates 59.1% vs 60.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#118
एकूण आउटपुट टोकन्स
4,915
प्रतिसाद वेळ (सरासरी)
2.35s
एकूण खर्च
$0.544
क्रमांक
#120
एकूण आउटपुट टोकन्स
270,259
प्रतिसाद वेळ (सरासरी)
32.56s
एकूण खर्च
$0.805
शिफारस केलेले मॉडेल GPT-5.5

It has the best score here (7.0), while responding about 13.8x faster than Grok 4.20 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.5 GPT-5.5 none प्रकाशन: 2026-04-24 Grok 4.20 Grok 4.20 medium प्रकाशन: 2026-03-31
स्कोअर 7.0 7.0
क्रमांक #118 #120
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 8.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.1% 60.6%
अस्थिर चाचण्या 2 5
एकूण रन 66 66
प्रति निकाल खर्च 4.533 10.365
एकूण खर्च $0.544 $0.805
इनपुट किंमत $5.000 / 1M $1.250 / 1M
आउटपुट किंमत $30.000 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 79,294 102,986
आउटपुट टोकन्स 4,915 5,860
रिझनिंग टोकन्स 0 264,399
प्रतिसाद वेळ (सरासरी) 2.35s 32.56s
प्रतिसाद वेळ (कमाल) 12.24s 199.66s
प्रतिसाद वेळ (एकूण) 51.78s 716.36s
पॅरामीटर्स ~1.5T एकूण (~100B सक्रिय) ~1T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 GPT-5.5

none
खर्च
$0.090
वेळ
54.3s
टोकन्स
3,063 tok

#120 SpaceXAI: Grok 4.20

medium
खर्च
$0.041
वेळ
110.3s
टोकन्स
16,336 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

झटपट तुलना

तुलना जोडी बदला