नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Sol vs Grok 4.20 (medium)

Grok 4.20 (medium) average score में आगे है: 7.1 vs 6.9. GPT-5.6 Sol की benchmark लागत कम है: $0.524 vs $0.777. GPT-5.6 Sol तेज है: 2.16s vs 29.47s, pass rates 59.1% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#91
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.16s
कुल लागत
$0.524
रैंक
#83
कुल आउटपुट टोकन
259,340
प्रतिक्रिया समय (औसत)
29.47s
कुल लागत
$0.777
अनुशंसित मॉडल GPT-5.6 Sol

Its score stays close to the best score here (6.9 vs 7.1), while responding about 13.6x faster than Grok 4.20 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 6.9 7.1
रैंक #91 #83
विश्वसनीयता 10.0 10.0
संगति 9.0 8.5
सही परीक्षण
प्रति प्रयास पास दर 59.1% 63.6%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 4.761 9.709
कुल लागत $0.524 $0.777
इनपुट कीमत $5.000 / 1M $1.250 / 1M
आउटपुट कीमत $30.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 78,593 102,791
आउटपुट टोकन 4,357 5,363
रीजनिंग टोकन 0 253,977
प्रतिक्रिया समय (औसत) 2.16s 29.47s
प्रतिक्रिया समय (अधिकतम) 12.81s 199.66s
प्रतिक्रिया समय (कुल) 47.62s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

#83 xAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

त्वरित तुलना

तुलना जोड़ी बदलें