नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.5 (medium) vs Grok 4.5 (high)

average score जवळपास समान आहे: 9.0 vs 9.0. Grok 4.5 (high) चा benchmark खर्च कमी आहे: $2.252 vs $4.163. GPT-5.5 (medium) वेगवान आहे: 38.97s vs 72.30s, pass rates 87.9% vs 86.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-29

क्रमांक
#19
एकूण आउटपुट टोकन्स
125,316
प्रतिसाद वेळ (सरासरी)
38.97s
एकूण खर्च
$4.163
क्रमांक
#21
एकूण आउटपुट टोकन्स
324,462
प्रतिसाद वेळ (सरासरी)
72.30s
एकूण खर्च
$2.252
शिफारस केलेले मॉडेल Grok 4.5 (high)

It has the best score here (9.0), while costing about 1.8x less than GPT-5.5 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.5 GPT-5.5 medium प्रकाशन: 2026-04-24 Grok 4.5 Grok 4.5 high प्रकाशन: 2026-07-08
स्कोअर 9.0 9.0
क्रमांक #19 #21
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 8.9
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 87.9% 86.4%
अस्थिर चाचण्या 3 3
एकूण रन 66 66
प्रति निकाल खर्च 23.127 12.565
एकूण खर्च $4.163 $2.252
इनपुट किंमत $5.000 / 1M $2.000 / 1M
आउटपुट किंमत $30.000 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 80,668 152,175
आउटपुट टोकन्स 5,617 5,655
रिझनिंग टोकन्स 119,699 318,807
प्रतिसाद वेळ (सरासरी) 38.97s 72.30s
प्रतिसाद वेळ (कमाल) 332.10s 676.83s
प्रतिसाद वेळ (एकूण) 857.43s 1590.56s
पॅरामीटर्स ~1.5T एकूण (~100B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 GPT-5.5

medium
खर्च
$0.112
वेळ
71.9s
टोकन्स
3,807 tok

#21 SpaceXAI: Grok 4.5

high
खर्च
$0.015
वेळ
29.7s
टोकन्स
2,737 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

झटपट तुलना

तुलना जोडी बदला