नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol — high बनाम low

low average score में आगे है: 9.5 vs 9.4. low की benchmark लागत कम है: $0.496 vs $0.629. low तेज है: 9.04s vs 11.48s, pass rates 89.4% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#9
कुल आउटपुट टोकन
28,708
प्रतिक्रिया समय (औसत)
11.48s
कुल लागत
$0.629
रैंक
#4
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.496
अनुशंसित मॉडल low

It has the strongest score in this comparison (9.5) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol high रिलीज़: 2026-07-09 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 9.4 9.5
रैंक #9 #4
विश्वसनीयता 10.0 10.0
संगति 8.9 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 89.4% 86.4%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 6.987 5.508
कुल लागत $0.629 $0.496
इनपुट कीमत $2.500 / 1M $2.500 / 1M
आउटपुट कीमत $15.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 79,258 78,580
आउटपुट टोकन 4,855 4,476
रीजनिंग टोकन 23,853 15,470
प्रतिक्रिया समय (औसत) 11.48s 9.04s
प्रतिक्रिया समय (अधिकतम) 54.79s 53.91s
प्रतिक्रिया समय (कुल) 252.62s 198.97s
पैरामीटर ~2T कुल (~150B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.6 Sol

high
लागत
$0.151
समय
201.9s
टोकन
5,100 tok

#4 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें