नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol — high बनाम medium

average score लगभग बराबर है: 9.4 vs 9.4. high की benchmark लागत कम है: $0.629 vs $0.723. high तेज है: 11.48s vs 12.63s, pass rates 89.4% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#9
कुल आउटपुट टोकन
28,708
प्रतिक्रिया समय (औसत)
11.48s
कुल लागत
$0.629
रैंक
#8
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.723
अनुशंसित मॉडल high

It has the strongest score in this comparison (9.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol high रिलीज़: 2026-07-09 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.4 9.4
रैंक #9 #8
विश्वसनीयता 10.0 10.0
संगति 8.9 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 89.4% 90.9%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 6.987 8.025
कुल लागत $0.629 $0.723
इनपुट कीमत $2.500 / 1M $2.500 / 1M
आउटपुट कीमत $15.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 79,258 79,006
आउटपुट टोकन 4,855 4,696
रीजनिंग टोकन 23,853 30,281
प्रतिक्रिया समय (औसत) 11.48s 12.63s
प्रतिक्रिया समय (अधिकतम) 54.79s 79.40s
प्रतिक्रिया समय (कुल) 252.62s 277.88s
पैरामीटर ~2T कुल (~150B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.6 Sol

high
लागत
$0.151
समय
201.9s
टोकन
5,100 tok

#8 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें