नेविगेशन
Advertise here

Claude Opus 5 (high) vs GPT-5.6 Sol (high)

GPT-5.6 Sol (high) average score में आगे है: 9.4 vs 9.2. GPT-5.6 Sol (high) की benchmark लागत कम है: $0.446 vs $3.070. GPT-5.6 Sol (high) तेज है: 11.48s vs 22.51s, pass rates 81.8% vs 89.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-07

तुलना किए गए मॉडल

रैंक
#20
कुल आउटपुट टोकन
95,583
प्रतिक्रिया समय (औसत)
22.51s
कुल लागत
$3.070
रैंक
#15
कुल आउटपुट टोकन
28,708
प्रतिक्रिया समय (औसत)
11.48s
कुल लागत
$0.446
अनुशंसित मॉडल GPT-5.6 Sol (high)

It has the best score here (9.4), while costing about 6.9x less than Claude Opus 5 (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 high रिलीज़: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol high रिलीज़: 2026-07-09
स्कोर 9.2 9.4
रैंक #20 #15
विश्वसनीयता 10.0 10.0
संगति 10.0 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 89.4%
अस्थिर टेस्ट 0 3
कुल रन 66 66
प्रति परिणाम लागत 17.052 6.987
कुल लागत $3.070 $0.446
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 135,956 79,258
आउटपुट टोकन 64,624 4,855
रीजनिंग टोकन 30,959 23,853
प्रतिक्रिया समय (औसत) 22.51s 11.48s
प्रतिक्रिया समय (अधिकतम) 159.01s 54.79s
प्रतिक्रिया समय (कुल) 495.12s 252.62s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Claude Opus 5

high
लागत
$0.265
समय
144.5s
टोकन
10,741 tok

#15 GPT-5.6 Sol

high
लागत
$0.151
समय
201.9s
टोकन
5,100 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656

त्वरित तुलना

तुलना जोड़ी बदलें