नेविगेशन
Advertise here

Claude Sonnet 5.5 (high) vs GPT-6 Sol (low)

GPT-6 Sol (low) average score में आगे है: 8.4 vs 8.3. GPT-6 Sol (low) की benchmark लागत कम है: $0.273 vs $0.752. GPT-6 Sol (low) तेज है: 6.92s vs 8.94s, pass rates 80.3% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#80
कुल आउटपुट टोकन
43,305
प्रतिक्रिया समय (औसत)
8.94s
कुल लागत
$0.752
रैंक
#74
कुल आउटपुट टोकन
11,677
प्रतिक्रिया समय (औसत)
6.92s
कुल लागत
$0.273
अनुशंसित मॉडल GPT-6 Sol (low)

It has the best score here (8.4), while costing about 2.8x less than Claude Sonnet 5.5 (high).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 high रिलीज़: 2026-09-29 GPT-6 Sol GPT-6 Sol low रिलीज़: 2026-09-23
स्कोर 8.3 8.4
रैंक #80 #74
विश्वसनीयता 10.0 10.0
संगति 8.3 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 80.3% 86.4%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 5.014 1.604
कुल लागत $0.752 $0.273
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 159,456 77,882
आउटपुट टोकन 10,170 4,047
रीजनिंग टोकन 33,135 7,630
प्रतिक्रिया समय (औसत) 8.94s 6.92s
प्रतिक्रिया समय (अधिकतम) 25.71s 17.91s
प्रतिक्रिया समय (कुल) 196.68s 152.17s
पैरामीटर ~1T कुल (~100B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Claude Sonnet 5.5

high
लागत
$0.088
समय
73.5s
टोकन
8,914 tok

#74 GPT-6 Sol

low
लागत
$0.018
समय
17.4s
टोकन
1,850 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5.5 10.0 10.0 100.0% 0 9.85s 10,608 561 6,326
GPT-6 Sol 6.2 4.8 66.7% 2 8.74s 7,302 405 1,296

त्वरित तुलना

तुलना जोड़ी बदलें