नेविगेशन
Advertise here

Claude Sonnet 5.5 (low) vs GPT-6 Sol

Claude Sonnet 5.5 (low) average score में आगे है: 6.9 vs 6.8. GPT-6 Sol की benchmark लागत कम है: $0.551 vs $0.909. Claude Sonnet 5.5 (low) तेज है: 7.46s vs 9.02s, pass rates 46.4% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#166
कुल आउटपुट टोकन
32,443
प्रतिक्रिया समय (औसत)
7.46s
कुल लागत
$0.909
रैंक
#172
कुल आउटपुट टोकन
7,989
प्रतिक्रिया समय (औसत)
9.02s
कुल लागत
$0.551
अनुशंसित मॉडल GPT-6 Sol

Its score stays close to the best score here (6.8 vs 6.9), while costing about 1.7x less than Claude Sonnet 5.5 (low).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 low रिलीज़: 2026-09-29 GPT-6 Sol GPT-6 Sol none रिलीज़: 2026-09-23
स्कोर 6.9 6.8
रैंक #166 #172
विश्वसनीयता 10.0 10.0
संगति 9.4 8.5
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 46.4% 63.8%
अस्थिर टेस्ट 2 4
कुल रन 69 69
प्रति परिणाम लागत 9.082 4.232
कुल लागत $0.909 $0.551
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 291,853 235,086
आउटपुट टोकन 24,116 7,989
रीजनिंग टोकन 8,327 0
प्रतिक्रिया समय (औसत) 7.46s 9.02s
प्रतिक्रिया समय (अधिकतम) 46.61s 57.02s
प्रतिक्रिया समय (कुल) 171.47s 207.45s
पैरामीटर ~1T कुल (~100B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Claude Sonnet 5.5

low
लागत
$0.020
समय
15.3s
टोकन
2,077 tok

#172 GPT-6 Sol

none
लागत
$0.030
समय
31.9s
टोकन
3,055 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5.5 3.2 9.7 0.0% 0 5.81s 10,608 5,903 0
GPT-6 Sol 5.5 10.0 33.3% 0 12.23s 7,302 389 0

त्वरित तुलना

तुलना जोड़ी बदलें