नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6.1 Sol — high बनाम low

high average score में आगे है: 9.6 vs 9.5. low की benchmark लागत कम है: $0.275 vs $0.542. low तेज है: 5.36s vs 13.68s, pass rates 93.9% vs 92.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#12
कुल आउटपुट टोकन
38,258
प्रतिक्रिया समय (औसत)
13.68s
कुल लागत
$0.542
रैंक
#16
कुल आउटपुट टोकन
11,879
प्रतिक्रिया समय (औसत)
5.36s
कुल लागत
$0.275
अनुशंसित मॉडल low

Its score stays close to the best score here (9.5 vs 9.6), while costing about 2.0x less than GPT-6.1 Sol (high).

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol high रिलीज़: 2026-09-29 GPT-6.1 Sol GPT-6.1 Sol low रिलीज़: 2026-09-29
स्कोर 9.6 9.5
रैंक #12 #16
विश्वसनीयता 10.0 10.0
संगति 9.6 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 93.9% 92.4%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 2.708 1.375
कुल लागत $0.542 $0.275
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 79,492 78,018
आउटपुट टोकन 4,954 4,160
रीजनिंग टोकन 33,304 7,719
प्रतिक्रिया समय (औसत) 13.68s 5.36s
प्रतिक्रिया समय (अधिकतम) 139.76s 29.38s
प्रतिक्रिया समय (कुल) 301.03s 117.89s
पैरामीटर ~2T कुल (~150B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 GPT-6.1 Sol

high
लागत
$0.079
समय
149.5s
टोकन
7,920 tok

#16 GPT-6.1 Sol

low
लागत
$0.028
समय
44.6s
टोकन
2,881 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 5.18s 7,302 390 2,215
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

त्वरित तुलना

तुलना जोड़ी बदलें