नेविगेशन
Advertise here

Claude Opus 5 (medium) vs GPT-6.1 Sol (high)

GPT-6.1 Sol (high) average score में आगे है: 9.6 vs 9.2. GPT-6.1 Sol (high) की benchmark लागत कम है: $0.542 vs $1.586. Claude Opus 5 (medium) तेज है: 10.26s vs 13.68s, pass rates 83.3% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#30
कुल आउटपुट टोकन
36,618
प्रतिक्रिया समय (औसत)
10.26s
कुल लागत
$1.586
रैंक
#12
कुल आउटपुट टोकन
38,258
प्रतिक्रिया समय (औसत)
13.68s
कुल लागत
$0.542
अनुशंसित मॉडल GPT-6.1 Sol (high)

It has the best score here (9.6), while costing about 2.9x less than Claude Opus 5 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 medium रिलीज़: 2026-07-25 GPT-6.1 Sol GPT-6.1 Sol high रिलीज़: 2026-09-29
स्कोर 9.2 9.6
रैंक #30 #12
विश्वसनीयता 10.0 10.0
संगति 9.6 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 93.9%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 8.811 2.708
कुल लागत $1.586 $0.542
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 135,604 79,492
आउटपुट टोकन 23,814 4,954
रीजनिंग टोकन 12,804 33,304
प्रतिक्रिया समय (औसत) 10.26s 13.68s
प्रतिक्रिया समय (अधिकतम) 35.43s 139.76s
प्रतिक्रिया समय (कुल) 225.66s 301.03s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Claude Opus 5

medium
लागत
$0.125
समय
69.3s
टोकन
5,134 tok

#12 GPT-6.1 Sol

high
लागत
$0.079
समय
149.5s
टोकन
7,920 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-6.1 Sol 10.0 10.0 100.0% 0 5.18s 7,302 390 2,215

त्वरित तुलना

तुलना जोड़ी बदलें