नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

तुलना किए गए मॉडल

GPT-6.1 Sol (xhigh) vs GPT-6 Astra (xhigh) vs Claude Sonnet 5.5 (xhigh) benchmark तुलना: GPT-6.1 Sol (xhigh) स्कोर में 9.9 के साथ आगे है। GPT-6.1 Sol (xhigh) विश्वसनीयता में 10.0 के साथ आगे है। Claude Sonnet 5.5 (xhigh) का कुल लागत सबसे कम है: $1.069. Claude Sonnet 5.5 (xhigh) 13.17s पर सबसे तेज है।

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#6
कुल आउटपुट टोकन
99,719
प्रतिक्रिया समय (औसत)
31.94s
कुल लागत
$1.156
रैंक
#8
कुल आउटपुट टोकन
87,183
प्रतिक्रिया समय (औसत)
28.44s
कुल लागत
$5.156
रैंक
#79
कुल आउटपुट टोकन
77,105
प्रतिक्रिया समय (औसत)
13.17s
कुल लागत
$1.069
अनुशंसित मॉडल GPT-6.1 Sol (xhigh)

It has the best score here (9.9), while costing about 2.7x less than इस तुलना के बाकी मॉडल.

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol xhigh रिलीज़: 2026-09-29 GPT-6 Astra GPT-6 Astra xhigh रिलीज़: 2026-09-04 Claude Sonnet 5.5 Claude Sonnet 5.5 xhigh रिलीज़: 2026-09-29
स्कोर 9.9 9.9 8.3
रैंक #6 #8 #79
विश्वसनीयता 10.0 9.9 10.0
संगति 9.6 9.6 8.7
प्रयास 66/66 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 97.0% 97.0% 78.8%
अस्थिर टेस्ट 1 1 4
कुल रन 66 66 66
प्रति परिणाम लागत 5.504 24.552 7.123
कुल लागत $1.156 $5.156 $1.069
इनपुट कीमत $2.000 / 1M $10.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $50.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 79,232 79,662 148,643
आउटपुट टोकन 4,811 5,055 9,700
रीजनिंग टोकन 94,908 82,128 67,405
प्रतिक्रिया समय (औसत) 31.94s 28.44s 13.17s
प्रतिक्रिया समय (अधिकतम) 491.85s 381.11s 54.91s
प्रतिक्रिया समय (कुल) 702.66s 625.68s 289.67s
पैरामीटर ~2T कुल (~150B सक्रिय) ~2T कुल (~150B सक्रिय) ~1T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#6 GPT-6.1 Sol

xhigh
लागत
$0.147
समय
279.4s
टोकन
14,790 tok

#8 GPT-6 Astra

xhigh
लागत
$0.694
समय
257.5s
टोकन
13,964 tok

#79 Claude Sonnet 5.5

xhigh
लागत
$0.319
समय
258.6s
टोकन
31,969 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 10.65s 7,302 393 4,483
GPT-6 Astra 10.0 10.0 100.0% 0 8.27s 7,302 396 4,031
Claude Sonnet 5.5 8.2 7.2 88.9% 1 11.90s 10,608 555 9,501

त्वरित तुलना

तुलना जोड़ी बदलें