नेविगेशन
Advertise here

GPT-6.1 Sol — low बनाम medium

medium average score में आगे है: 9.6 vs 9.5. low की benchmark लागत कम है: $0.275 vs $0.326. low तेज है: 5.36s vs 6.99s, pass rates 92.4% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#16
कुल आउटपुट टोकन
11,879
प्रतिक्रिया समय (औसत)
5.36s
कुल लागत
$0.275
रैंक
#11
कुल आउटपुट टोकन
16,852
प्रतिक्रिया समय (औसत)
6.99s
कुल लागत
$0.326
अनुशंसित मॉडल low

It offers the best overall trade-off: a competitive score (9.5), lower cost than GPT-6.1 Sol (medium), and balanced response time.

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol low रिलीज़: 2026-09-29 GPT-6.1 Sol GPT-6.1 Sol medium रिलीज़: 2026-09-29
स्कोर 9.5 9.6
रैंक #16 #11
विश्वसनीयता 10.0 10.0
संगति 9.6 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 92.4% 93.9%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 1.375 1.627
कुल लागत $0.275 $0.326
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 78,018 78,368
आउटपुट टोकन 4,160 4,354
रीजनिंग टोकन 7,719 12,498
प्रतिक्रिया समय (औसत) 5.36s 6.99s
प्रतिक्रिया समय (अधिकतम) 29.38s 50.74s
प्रतिक्रिया समय (कुल) 117.89s 153.75s
पैरामीटर ~2T कुल (~150B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#16 GPT-6.1 Sol

low
लागत
$0.028
समय
44.6s
टोकन
2,881 tok

#11 GPT-6.1 Sol

medium
लागत
$0.045
समय
72.7s
टोकन
4,581 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.74s 7,302 393 1,710

त्वरित तुलना

तुलना जोड़ी बदलें