नेविगेशन
Advertise here

GPT-6.1 Sol — max बनाम medium

max average score में आगे है: 9.9 vs 9.6. medium की benchmark लागत कम है: $0.326 vs $0.740. medium तेज है: 6.99s vs 61.16s, pass rates 95.5% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#4
कुल आउटपुट टोकन
58,145
प्रतिक्रिया समय (औसत)
61.16s
कुल लागत
$0.740
रैंक
#11
कुल आउटपुट टोकन
16,852
प्रतिक्रिया समय (औसत)
6.99s
कुल लागत
$0.326
अनुशंसित मॉडल medium

Its score stays close to the best score here (9.6 vs 9.9), while costing about 2.3x less than GPT-6.1 Sol (max).

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol max रिलीज़: 2026-09-29 GPT-6.1 Sol GPT-6.1 Sol medium रिलीज़: 2026-09-29
स्कोर 9.9 9.6
रैंक #4 #11
विश्वसनीयता 9.6 10.0
संगति 10.0 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 95.5% 93.9%
अस्थिर टेस्ट 0 1
कुल रन 66 66
प्रति परिणाम लागत 3.523 1.627
कुल लागत $0.740 $0.326
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 79,136 78,368
आउटपुट टोकन 4,913 4,354
रीजनिंग टोकन 53,232 12,498
प्रतिक्रिया समय (औसत) 61.16s 6.99s
प्रतिक्रिया समय (अधिकतम) 960.01s 50.74s
प्रतिक्रिया समय (कुल) 1345.41s 153.75s
पैरामीटर ~2T कुल (~150B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 GPT-6.1 Sol

max
लागत
$0.272
समय
584.0s
टोकन
27,273 tok

#11 GPT-6.1 Sol

medium
लागत
$0.045
समय
72.7s
टोकन
4,581 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 13.57s 7,302 398 7,668
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.74s 7,302 393 1,710

त्वरित तुलना

तुलना जोड़ी बदलें