नेविगेशन
Advertise here

Claude Sonnet 5.5 (xhigh) vs GPT-6 Sol (low)

GPT-6 Sol (low) average score में आगे है: 8.4 vs 8.3. GPT-6 Sol (low) की benchmark लागत कम है: $0.273 vs $1.069. GPT-6 Sol (low) तेज है: 6.92s vs 13.17s, pass rates 78.8% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#79
कुल आउटपुट टोकन
77,105
प्रतिक्रिया समय (औसत)
13.17s
कुल लागत
$1.069
रैंक
#74
कुल आउटपुट टोकन
11,677
प्रतिक्रिया समय (औसत)
6.92s
कुल लागत
$0.273
अनुशंसित मॉडल GPT-6 Sol (low)

It has the best score here (8.4), while costing about 3.9x less than Claude Sonnet 5.5 (xhigh).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 xhigh रिलीज़: 2026-09-29 GPT-6 Sol GPT-6 Sol low रिलीज़: 2026-09-23
स्कोर 8.3 8.4
रैंक #79 #74
विश्वसनीयता 10.0 10.0
संगति 8.7 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 86.4%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 7.123 1.604
कुल लागत $1.069 $0.273
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 148,643 77,882
आउटपुट टोकन 9,700 4,047
रीजनिंग टोकन 67,405 7,630
प्रतिक्रिया समय (औसत) 13.17s 6.92s
प्रतिक्रिया समय (अधिकतम) 54.91s 17.91s
प्रतिक्रिया समय (कुल) 289.67s 152.17s
पैरामीटर ~1T कुल (~100B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 Claude Sonnet 5.5

xhigh
लागत
$0.319
समय
258.6s
टोकन
31,969 tok

#74 GPT-6 Sol

low
लागत
$0.018
समय
17.4s
टोकन
1,850 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5.5 8.2 7.2 88.9% 1 11.90s 10,608 555 9,501
GPT-6 Sol 6.2 4.8 66.7% 2 8.74s 7,302 405 1,296

त्वरित तुलना

तुलना जोड़ी बदलें