नेविगेशन
Advertise here

Claude Opus 5.5 (low) vs GPT-6 Sol (high)

GPT-6 Sol (high) average score में आगे है: 9.9 vs 9.3. GPT-6 Sol (high) की benchmark लागत कम है: $0.684 vs $0.952. GPT-6 Sol (high) तेज है: 22.21s vs 23.72s, pass rates 87.9% vs 95.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#20
कुल आउटपुट टोकन
21,004
प्रतिक्रिया समय (औसत)
23.72s
कुल लागत
$0.952
रैंक
#3
कुल आउटपुट टोकन
52,589
प्रतिक्रिया समय (औसत)
22.21s
कुल लागत
$0.684
अनुशंसित मॉडल GPT-6 Sol (high)

It has the strongest score in this comparison (9.9) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 low रिलीज़: 2026-09-23 GPT-6 Sol GPT-6 Sol high रिलीज़: 2026-09-23
स्कोर 9.3 9.9
रैंक #20 #3
विश्वसनीयता 10.0 10.0
संगति 9.3 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 87.9% 95.5%
अस्थिर टेस्ट 2 0
कुल रन 66 66
प्रति परिणाम लागत 5.284 3.256
कुल लागत $0.952 $0.684
इनपुट कीमत $4.000 / 1M $2.000 / 1M
आउटपुट कीमत $20.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 132,746 78,900
आउटपुट टोकन 6,454 4,627
रीजनिंग टोकन 14,550 47,962
प्रतिक्रिया समय (औसत) 23.72s 22.21s
प्रतिक्रिया समय (अधिकतम) 89.16s 136.22s
प्रतिक्रिया समय (कुल) 521.82s 488.52s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Claude Opus 5.5

low
अमान्य SVG
लागत
$0.038
समय
19.1s
टोकन
2,010 tok

#3 GPT-6 Sol

high
लागत
$0.076
समय
91.0s
टोकन
7,593 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5.5 10.0 10.0 100.0% 0 12.23s 10,608 575 2,777
GPT-6 Sol 10.0 10.0 100.0% 0 19.12s 7,302 391 4,970

त्वरित तुलना

तुलना जोड़ी बदलें