नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.5 (low) vs Grok 4.6 (high)

GPT-5.5 (low) average score मध्ये पुढे आहे: 9.3 vs 9.2. GPT-5.5 (low) चा benchmark खर्च कमी आहे: $1.253 vs $1.809. GPT-5.5 (low) वेगवान आहे: 10.13s vs 79.38s, pass rates 86.4% vs 84.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-12

क्रमांक
#8
एकूण आउटपुट टोकन्स
28,418
प्रतिसाद वेळ (सरासरी)
10.13s
एकूण खर्च
$1.253
क्रमांक
#11
एकूण आउटपुट टोकन्स
265,604
प्रतिसाद वेळ (सरासरी)
79.38s
एकूण खर्च
$1.809
शिफारस केलेले मॉडेल GPT-5.5 (low)

It has the best score here (9.3), while responding about 7.8x faster than Grok 4.6 (high).

तपशीलवार तुलना

मेट्रिक GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24 Grok 4.6 Grok 4.6 high प्रकाशन: 2026-08-12
स्कोअर 9.3 9.2
क्रमांक #8 #11
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 9.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 86.4% 84.9%
अस्थिर चाचण्या 0 1
एकूण रन 66 66
प्रति निकाल खर्च 6.594 10.046
एकूण खर्च $1.253 $1.809
इनपुट किंमत $5.000 / 1M $2.000 / 1M
आउटपुट किंमत $30.000 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 80,058 107,266
आउटपुट टोकन्स 5,378 5,094
रिझनिंग टोकन्स 23,040 260,510
प्रतिसाद वेळ (सरासरी) 10.13s 79.38s
प्रतिसाद वेळ (कमाल) 56.19s 618.49s
प्रतिसाद वेळ (एकूण) 222.82s 1746.29s
पॅरामीटर्स ~1.5T एकूण (~100B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#8 GPT-5.5

low
खर्च
$0.068
वेळ
37.0s
टोकन्स
2,339 tok

#11 SpaceXAI: Grok 4.6

high
खर्च
$0.107
वेळ
265.1s
टोकन्स
18,001 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829

झटपट तुलना

तुलना जोडी बदला