नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6.1 Sol — high बनाम medium

average score लगभग बराबर है: 9.6 vs 9.6. medium की benchmark लागत कम है: $0.326 vs $0.542. medium तेज है: 6.99s vs 13.68s, pass rates 93.9% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#12
कुल आउटपुट टोकन
38,258
प्रतिक्रिया समय (औसत)
13.68s
कुल लागत
$0.542
रैंक
#11
कुल आउटपुट टोकन
16,852
प्रतिक्रिया समय (औसत)
6.99s
कुल लागत
$0.326
अनुशंसित मॉडल medium

It has the best score here (9.6), while costing about 1.7x less than GPT-6.1 Sol (high).

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol high रिलीज़: 2026-09-29 GPT-6.1 Sol GPT-6.1 Sol medium रिलीज़: 2026-09-29
स्कोर 9.6 9.6
रैंक #12 #11
विश्वसनीयता 10.0 10.0
संगति 9.6 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 93.9% 93.9%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 2.708 1.627
कुल लागत $0.542 $0.326
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 79,492 78,368
आउटपुट टोकन 4,954 4,354
रीजनिंग टोकन 33,304 12,498
प्रतिक्रिया समय (औसत) 13.68s 6.99s
प्रतिक्रिया समय (अधिकतम) 139.76s 50.74s
प्रतिक्रिया समय (कुल) 301.03s 153.75s
पैरामीटर ~2T कुल (~150B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 GPT-6.1 Sol

high
लागत
$0.079
समय
149.5s
टोकन
7,920 tok

#11 GPT-6.1 Sol

medium
लागत
$0.045
समय
72.7s
टोकन
4,581 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 5.18s 7,302 390 2,215
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.74s 7,302 393 1,710

त्वरित तुलना

तुलना जोड़ी बदलें