नेविगेशन
Advertise here

Claude Opus 4.8 vs GPT-6 Sol

Claude Opus 4.8 average score में आगे है: 7.3 vs 7.2. GPT-6 Sol की benchmark लागत कम है: $0.280 vs $1.166. Claude Opus 4.8 तेज है: 4.92s vs 6.84s, pass rates 63.6% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#144
कुल आउटपुट टोकन
16,797
प्रतिक्रिया समय (औसत)
4.92s
कुल लागत
$1.166
रैंक
#148
कुल आउटपुट टोकन
6,696
प्रतिक्रिया समय (औसत)
6.84s
कुल लागत
$0.280
अनुशंसित मॉडल GPT-6 Sol

Its score stays close to the best score here (7.2 vs 7.3), while costing about 4.2x less than Claude Opus 4.8.

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none रिलीज़: 2026-05-28 GPT-6 Sol GPT-6 Sol none रिलीज़: 2026-09-23
स्कोर 7.3 7.2
रैंक #144 #148
विश्वसनीयता 10.0 10.0
संगति 9.2 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 66.7%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 8.969 2.151
कुल लागत $1.166 $0.280
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 149,203 106,332
आउटपुट टोकन 16,797 6,696
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 4.92s 6.84s
प्रतिक्रिया समय (अधिकतम) 35.03s 23.89s
प्रतिक्रिया समय (कुल) 108.24s 150.43s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Claude Opus 4.8

none
लागत
$0.053
समय
22.0s
टोकन
2,253 tok

#148 GPT-6 Sol

none
लागत
$0.030
समय
31.9s
टोकन
3,055 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
GPT-6 Sol 5.5 10.0 33.3% 0 12.23s 7,302 389 0

त्वरित तुलना

तुलना जोड़ी बदलें