नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.5 vs Grok 4.20 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.5 की benchmark लागत कम है: $0.544 vs $0.805. GPT-5.5 तेज है: 2.35s vs 32.56s, pass rates 59.1% vs 60.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#118
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
रैंक
#120
कुल आउटपुट टोकन
270,259
प्रतिक्रिया समय (औसत)
32.56s
कुल लागत
$0.805
अनुशंसित मॉडल GPT-5.5

It has the best score here (7.0), while responding about 13.8x faster than Grok 4.20 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 7.0 7.0
रैंक #118 #120
विश्वसनीयता 10.0 10.0
संगति 9.2 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 59.1% 60.6%
अस्थिर टेस्ट 2 5
कुल रन 66 66
प्रति परिणाम लागत 4.533 10.365
कुल लागत $0.544 $0.805
इनपुट कीमत $5.000 / 1M $1.250 / 1M
आउटपुट कीमत $30.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 79,294 102,986
आउटपुट टोकन 4,915 5,860
रीजनिंग टोकन 0 264,399
प्रतिक्रिया समय (औसत) 2.35s 32.56s
प्रतिक्रिया समय (अधिकतम) 12.24s 199.66s
प्रतिक्रिया समय (कुल) 51.78s 716.36s
पैरामीटर ~1.5T कुल (~100B सक्रिय) ~1T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

#120 SpaceXAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

त्वरित तुलना

तुलना जोड़ी बदलें