नेविगेशन
Advertise here

GPT-5.6 Sol vs Grok Build 0.1 (medium)

average score लगभग बराबर है: 6.7 vs 6.7. GPT-5.6 Sol की benchmark लागत कम है: $0.472 vs $1.419. GPT-5.6 Sol तेज है: 4.61s vs 55.13s, pass rates 60.9% vs 58.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#183
कुल आउटपुट टोकन
5,555
प्रतिक्रिया समय (औसत)
4.61s
कुल लागत
$0.472
रैंक
#176
कुल आउटपुट टोकन
529,806
प्रतिक्रिया समय (औसत)
55.13s
कुल लागत
$1.419
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (6.7), while costing about 3.0x less than Grok Build 0.1 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09 Grok Build 0.1 Grok Build 0.1 medium रिलीज़: 2026-05-21
स्कोर 6.7 6.7
रैंक #183 #176
विश्वसनीयता 10.0 10.0
संगति 9.1 9.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 58.0%
अस्थिर टेस्ट 3 1
कुल रन 69 69
प्रति परिणाम लागत 6.619 10.910
कुल लागत $0.472 $1.419
इनपुट कीमत $2.000 / 1M $1.000 / 1M
आउटपुट कीमत $10.000 / 1M $2.000 / 1M
कुल इनपुट टोकन 207,852 358,616
आउटपुट टोकन 5,555 9,651
रीजनिंग टोकन 0 520,155
प्रतिक्रिया समय (औसत) 4.61s 55.13s
प्रतिक्रिया समय (अधिकतम) 58.28s 252.69s
प्रतिक्रिया समय (कुल) 105.93s 1268.10s
पैरामीटर ~2T कुल (~150B सक्रिय) ~300B कुल (~30B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#183 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

#176 SpaceXAI: Grok Build 0.1

medium
लागत
$0.028
समय
81.3s
टोकन
14,009 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

त्वरित तुलना

तुलना जोड़ी बदलें