नेविगेशन
AI BENCHY
Advertise here

GPT-5.5 vs Grok 4.3 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.5 की benchmark लागत कम है: $0.544 vs $0.741. GPT-5.5 तेज है: 2.35s vs 44.21s, pass rates 59.1% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#118
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
रैंक
#114
कुल आउटपुट टोकन
225,904
प्रतिक्रिया समय (औसत)
44.21s
कुल लागत
$0.741
अनुशंसित मॉडल GPT-5.5

It has the best score here (7.0), while responding about 18.8x faster than Grok 4.3 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 7.0 7.0
रैंक #118 #114
विश्वसनीयता 10.0 10.0
संगति 9.2 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 59.1% 66.7%
अस्थिर टेस्ट 2 5
कुल रन 66 66
प्रति परिणाम लागत 4.533 6.168
कुल लागत $0.544 $0.741
इनपुट कीमत $5.000 / 1M $1.250 / 1M
आउटपुट कीमत $30.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 79,294 140,244
आउटपुट टोकन 4,915 13,739
रीजनिंग टोकन 0 212,165
प्रतिक्रिया समय (औसत) 2.35s 44.21s
प्रतिक्रिया समय (अधिकतम) 12.24s 216.69s
प्रतिक्रिया समय (कुल) 51.78s 972.64s
पैरामीटर ~1.5T कुल (~100B सक्रिय) ~1.5T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

#114 SpaceXAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

त्वरित तुलना

तुलना जोड़ी बदलें