नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Sol vs Grok 4.7 (high)

average score लगभग बराबर है: 6.7 vs 6.7. GPT-5.6 Sol की benchmark लागत कम है: $0.472 vs $3.582. GPT-5.6 Sol तेज है: 4.61s vs 122.19s, pass rates 60.9% vs 72.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#183
कुल आउटपुट टोकन
5,555
प्रतिक्रिया समय (औसत)
4.61s
कुल लागत
$0.472
रैंक
#179
कुल आउटपुट टोकन
487,184
प्रतिक्रिया समय (औसत)
122.19s
कुल लागत
$3.582
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (6.7), while costing about 7.6x less than Grok 4.7 (high).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09 Grok 4.7 Grok 4.7 high रिलीज़: 2026-09-21
स्कोर 6.7 6.7
रैंक #183 #179
विश्वसनीयता 10.0 9.6
संगति 9.1 7.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 72.5%
अस्थिर टेस्ट 3 7
कुल रन 69 69
प्रति परिणाम लागत 6.619 23.360
कुल लागत $0.472 $3.582
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 207,852 329,276
आउटपुट टोकन 5,555 8,172
रीजनिंग टोकन 0 479,012
प्रतिक्रिया समय (औसत) 4.61s 122.19s
प्रतिक्रिया समय (अधिकतम) 58.28s 573.57s
प्रतिक्रिया समय (कुल) 105.93s 2810.40s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#183 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

#179 SpaceXAI: Grok 4.7

high
लागत
$0.110
समय
301.3s
टोकन
23,143 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

त्वरित तुलना

तुलना जोड़ी बदलें