नेविगेशन
Advertise here

Claude Opus 5.5 (high) vs GPT-5.6 Sol (medium)

GPT-5.6 Sol (medium) average score में आगे है: 9.4 vs 9.3. GPT-5.6 Sol (medium) की benchmark लागत कम है: $0.508 vs $1.266. GPT-5.6 Sol (medium) तेज है: 12.63s vs 25.88s, pass rates 86.4% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#21
कुल आउटपुट टोकन
36,457
प्रतिक्रिया समय (औसत)
25.88s
कुल लागत
$1.266
रैंक
#15
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.508
अनुशंसित मॉडल GPT-5.6 Sol (medium)

It has the best score here (9.4), while costing about 2.5x less than Claude Opus 5.5 (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 high रिलीज़: 2026-09-23 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.3 9.4
रैंक #21 #15
विश्वसनीयता 10.0 10.0
संगति 9.3 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 90.9%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 7.029 8.025
कुल लागत $1.266 $0.508
इनपुट कीमत $4.000 / 1M $2.000 / 1M
आउटपुट कीमत $20.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 134,020 79,006
आउटपुट टोकन 7,237 4,696
रीजनिंग टोकन 29,220 30,281
प्रतिक्रिया समय (औसत) 25.88s 12.63s
प्रतिक्रिया समय (अधिकतम) 95.95s 79.40s
प्रतिक्रिया समय (कुल) 569.33s 277.88s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Claude Opus 5.5

high
लागत
$0.136
समय
75.6s
टोकन
6,934 tok

#15 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5.5 10.0 10.0 100.0% 0 13.44s 10,608 584 5,042
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें