नेविगेशन
Advertise here

Claude Opus 5 (medium) vs GPT-5.6 Sol (low)

GPT-5.6 Sol (low) average score में आगे है: 9.5 vs 9.2. GPT-5.6 Sol (low) की benchmark लागत कम है: $0.357 vs $1.586. GPT-5.6 Sol (low) तेज है: 9.04s vs 10.26s, pass rates 83.3% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-18

तुलना किए गए मॉडल

रैंक
#21
कुल आउटपुट टोकन
36,618
प्रतिक्रिया समय (औसत)
10.26s
कुल लागत
$1.586
रैंक
#8
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.357
अनुशंसित मॉडल GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 4.4x less than Claude Opus 5 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 medium रिलीज़: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 9.2 9.5
रैंक #21 #8
विश्वसनीयता 10.0 10.0
संगति 9.6 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 86.4%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 8.811 5.508
कुल लागत $1.586 $0.357
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 135,604 78,580
आउटपुट टोकन 23,814 4,476
रीजनिंग टोकन 12,804 15,470
प्रतिक्रिया समय (औसत) 10.26s 9.04s
प्रतिक्रिया समय (अधिकतम) 35.43s 53.91s
प्रतिक्रिया समय (कुल) 225.66s 198.97s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Claude Opus 5

medium
लागत
$0.125
समय
69.3s
टोकन
5,134 tok

#8 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें