नेविगेशन
AI BENCHY
Advertise here

GPT-5.5 (medium) vs Grok 4.5 (high)

average score लगभग बराबर है: 9.0 vs 9.0. Grok 4.5 (high) की benchmark लागत कम है: $2.252 vs $4.163. GPT-5.5 (medium) तेज है: 38.97s vs 72.30s, pass rates 87.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#19
कुल आउटपुट टोकन
125,316
प्रतिक्रिया समय (औसत)
38.97s
कुल लागत
$4.163
रैंक
#21
कुल आउटपुट टोकन
324,462
प्रतिक्रिया समय (औसत)
72.30s
कुल लागत
$2.252
अनुशंसित मॉडल Grok 4.5 (high)

It has the best score here (9.0), while costing about 1.8x less than GPT-5.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 9.0 9.0
रैंक #19 #21
विश्वसनीयता 10.0 10.0
संगति 8.9 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 87.9% 86.4%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 23.127 12.565
कुल लागत $4.163 $2.252
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $30.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 80,668 152,175
आउटपुट टोकन 5,617 5,655
रीजनिंग टोकन 119,699 318,807
प्रतिक्रिया समय (औसत) 38.97s 72.30s
प्रतिक्रिया समय (अधिकतम) 332.10s 676.83s
प्रतिक्रिया समय (कुल) 857.43s 1590.56s
पैरामीटर ~1.5T कुल (~100B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

#21 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें