नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol — low बनाम medium

low average score में आगे है: 9.5 vs 9.4. low की benchmark लागत कम है: $0.496 vs $0.723. low तेज है: 9.04s vs 12.63s, pass rates 86.4% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#4
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.496
रैंक
#8
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.723
अनुशंसित मॉडल low

It has the strongest score in this comparison (9.5) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.5 9.4
रैंक #4 #8
विश्वसनीयता 10.0 10.0
संगति 9.2 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 90.9%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 5.508 8.025
कुल लागत $0.496 $0.723
इनपुट कीमत $2.500 / 1M $2.500 / 1M
आउटपुट कीमत $15.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 78,580 79,006
आउटपुट टोकन 4,476 4,696
रीजनिंग टोकन 15,470 30,281
प्रतिक्रिया समय (औसत) 9.04s 12.63s
प्रतिक्रिया समय (अधिकतम) 53.91s 79.40s
प्रतिक्रिया समय (कुल) 198.97s 277.88s
पैरामीटर ~2T कुल (~150B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

#8 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें