नेविगेशन
Advertise here

GPT-5.6 Sol vs Grok 4.7 (xhigh)

Grok 4.7 (xhigh) average score में आगे है: 6.7 vs 6.7. GPT-5.6 Sol की benchmark लागत कम है: $0.472 vs $4.054. GPT-5.6 Sol तेज है: 4.61s vs 123.96s, pass rates 60.9% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#183
कुल आउटपुट टोकन
5,555
प्रतिक्रिया समय (औसत)
4.61s
कुल लागत
$0.472
रैंक
#175
कुल आउटपुट टोकन
572,315
प्रतिक्रिया समय (औसत)
123.96s
कुल लागत
$4.054
अनुशंसित मॉडल GPT-5.6 Sol

Its score stays close to the best score here (6.7 vs 6.7), while costing about 8.6x less than Grok 4.7 (xhigh).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09 Grok 4.7 Grok 4.7 xhigh रिलीज़: 2026-09-21
स्कोर 6.7 6.7
रैंक #183 #175
विश्वसनीयता 10.0 9.7
संगति 9.1 7.8
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 73.9%
अस्थिर टेस्ट 3 6
कुल रन 69 69
प्रति परिणाम लागत 6.619 24.272
कुल लागत $0.472 $4.054
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 207,852 310,049
आउटपुट टोकन 5,555 6,094
रीजनिंग टोकन 0 566,221
प्रतिक्रिया समय (औसत) 4.61s 123.96s
प्रतिक्रिया समय (अधिकतम) 58.28s 775.64s
प्रतिक्रिया समय (कुल) 105.93s 2851.07s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#183 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

#175 SpaceXAI: Grok 4.7

xhigh
लागत
$0.235
समय
544.2s
टोकन
39,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.7 5.3 4.5 55.6% 2 414.53s 10,168 327 256,935

त्वरित तुलना

तुलना जोड़ी बदलें