नेविगेशन
Advertise here

Claude Opus 5.5 (low) vs GPT-6 Sol (medium)

GPT-6 Sol (medium) average score में आगे है: 9.4 vs 9.3. GPT-6 Sol (medium) की benchmark लागत कम है: $0.448 vs $0.952. GPT-6 Sol (medium) तेज है: 10.33s vs 23.72s, pass rates 87.9% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#20
कुल आउटपुट टोकन
21,004
प्रतिक्रिया समय (औसत)
23.72s
कुल लागत
$0.952
रैंक
#14
कुल आउटपुट टोकन
29,115
प्रतिक्रिया समय (औसत)
10.33s
कुल लागत
$0.448
अनुशंसित मॉडल GPT-6 Sol (medium)

It has the best score here (9.4), while costing about 2.1x less than Claude Opus 5.5 (low).

विस्तृत तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 low रिलीज़: 2026-09-23 GPT-6 Sol GPT-6 Sol medium रिलीज़: 2026-09-23
स्कोर 9.3 9.4
रैंक #20 #14
विश्वसनीयता 10.0 10.0
संगति 9.3 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 87.9% 93.9%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 5.284 2.240
कुल लागत $0.952 $0.448
इनपुट कीमत $4.000 / 1M $2.000 / 1M
आउटपुट कीमत $20.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 132,746 78,376
आउटपुट टोकन 6,454 4,309
रीजनिंग टोकन 14,550 24,806
प्रतिक्रिया समय (औसत) 23.72s 10.33s
प्रतिक्रिया समय (अधिकतम) 89.16s 82.74s
प्रतिक्रिया समय (कुल) 521.82s 227.17s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Claude Opus 5.5

low
अमान्य SVG
लागत
$0.038
समय
19.1s
टोकन
2,010 tok

#14 GPT-6 Sol

medium
लागत
$0.035
समय
36.9s
टोकन
3,493 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5.5 10.0 10.0 100.0% 0 12.23s 10,608 575 2,777
GPT-6 Sol 8.2 7.2 88.9% 1 11.78s 7,302 392 2,532

त्वरित तुलना

तुलना जोड़ी बदलें