नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

तुलना किए गए मॉडल

GPT-5.6 Sol (low) vs Grok 4.6 (high) vs Claude Opus 5 (high) benchmark तुलना: GPT-5.6 Sol (low) स्कोर में 9.5 के साथ आगे है। GPT-5.6 Sol (low) विश्वसनीयता में 10.0 के साथ आगे है। GPT-5.6 Sol (low) का कुल लागत सबसे कम है: $0.357. GPT-5.6 Sol (low) 9.04s पर सबसे तेज है।

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#9
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.357
रैंक
#19
कुल आउटपुट टोकन
282,217
प्रतिक्रिया समय (औसत)
84.15s
कुल लागत
$1.908
रैंक
#24
कुल आउटपुट टोकन
95,583
प्रतिक्रिया समय (औसत)
22.51s
कुल लागत
$3.070
अनुशंसित मॉडल GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 7.0x less than इस तुलना के बाकी मॉडल.

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09 Grok 4.6 Grok 4.6 high रिलीज़: 2026-08-12 Claude Opus 5 Claude Opus 5 high रिलीज़: 2026-07-25
स्कोर 9.5 9.3 9.2
रैंक #9 #19 #24
विश्वसनीयता 10.0 10.0 10.0
संगति 9.2 10.0 10.0
प्रयास 66/66 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 86.4% 81.8%
अस्थिर टेस्ट 2 0 0
कुल रन 66 66 66
प्रति परिणाम लागत 5.508 10.042 17.052
कुल लागत $0.357 $1.908 $3.070
इनपुट कीमत $2.000 / 1M $2.000 / 1M $5.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M $25.000 / 1M
कुल इनपुट टोकन 78,580 107,275 135,956
आउटपुट टोकन 4,476 5,094 64,624
रीजनिंग टोकन 15,470 277,123 30,959
प्रतिक्रिया समय (औसत) 9.04s 84.15s 22.51s
प्रतिक्रिया समय (अधिकतम) 53.91s 618.49s 159.01s
प्रतिक्रिया समय (कुल) 198.97s 1851.26s 495.12s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1.7T कुल (~170B सक्रिय) ~5T कुल (~500B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

#19 SpaceXAI: Grok 4.6

high
लागत
$0.107
समय
265.1s
टोकन
18,001 tok

#24 Claude Opus 5

high
लागत
$0.265
समय
144.5s
टोकन
10,741 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721

त्वरित तुलना

तुलना जोड़ी बदलें