नेविगेशन
Advertise here

GPT-5.6 Sol vs Grok 4.20 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.6 Sol की benchmark लागत कम है: $0.201 vs $0.805. GPT-5.6 Sol तेज है: 2.17s vs 32.56s, pass rates 63.6% vs 60.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#140
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.17s
कुल लागत
$0.201
रैंक
#145
कुल आउटपुट टोकन
270,259
प्रतिक्रिया समय (औसत)
32.56s
कुल लागत
$0.805
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (7.0), while costing about 4.0x less than Grok 4.20 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 7.0 7.0
रैंक #140 #145
विश्वसनीयता 10.0 10.0
संगति 9.0 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 60.6%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 4.365 10.365
कुल लागत $0.201 $0.805
इनपुट कीमत $2.000 / 1M $1.250 / 1M
आउटपुट कीमत $10.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 78,602 102,986
आउटपुट टोकन 4,357 5,860
रीजनिंग टोकन 0 264,399
प्रतिक्रिया समय (औसत) 2.17s 32.56s
प्रतिक्रिया समय (अधिकतम) 12.81s 199.66s
प्रतिक्रिया समय (कुल) 47.66s 716.36s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#140 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

#145 SpaceXAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

त्वरित तुलना

तुलना जोड़ी बदलें