नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol vs Grok 4.3 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.6 Sol की benchmark लागत कम है: $0.524 vs $0.741. GPT-5.6 Sol तेज है: 2.17s vs 44.21s, pass rates 63.6% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#115
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.17s
कुल लागत
$0.524
रैंक
#114
कुल आउटपुट टोकन
225,904
प्रतिक्रिया समय (औसत)
44.21s
कुल लागत
$0.741
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (7.0), while responding about 20.4x faster than Grok 4.3 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 7.0 7.0
रैंक #115 #114
विश्वसनीयता 10.0 10.0
संगति 9.0 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 66.7%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 4.365 6.168
कुल लागत $0.524 $0.741
इनपुट कीमत $5.000 / 1M $1.250 / 1M
आउटपुट कीमत $30.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 78,602 140,244
आउटपुट टोकन 4,357 13,739
रीजनिंग टोकन 0 212,165
प्रतिक्रिया समय (औसत) 2.17s 44.21s
प्रतिक्रिया समय (अधिकतम) 12.81s 216.69s
प्रतिक्रिया समय (कुल) 47.66s 972.64s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1.5T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

#114 SpaceXAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

त्वरित तुलना

तुलना जोड़ी बदलें