नेविगेशन
Advertise here

Claude Opus 5 (medium) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) average score में आगे है: 9.5 vs 9.2. GPT-6.1 Sol (low) की benchmark लागत कम है: $0.275 vs $1.586. GPT-6.1 Sol (low) तेज है: 5.36s vs 10.26s, pass rates 83.3% vs 92.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#30
कुल आउटपुट टोकन
36,618
प्रतिक्रिया समय (औसत)
10.26s
कुल लागत
$1.586
रैंक
#16
कुल आउटपुट टोकन
11,879
प्रतिक्रिया समय (औसत)
5.36s
कुल लागत
$0.275
अनुशंसित मॉडल GPT-6.1 Sol (low)

It has the best score here (9.5), while costing about 5.8x less than Claude Opus 5 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 medium रिलीज़: 2026-07-25 GPT-6.1 Sol GPT-6.1 Sol low रिलीज़: 2026-09-29
स्कोर 9.2 9.5
रैंक #30 #16
विश्वसनीयता 10.0 10.0
संगति 9.6 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 92.4%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 8.811 1.375
कुल लागत $1.586 $0.275
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 135,604 78,018
आउटपुट टोकन 23,814 4,160
रीजनिंग टोकन 12,804 7,719
प्रतिक्रिया समय (औसत) 10.26s 5.36s
प्रतिक्रिया समय (अधिकतम) 35.43s 29.38s
प्रतिक्रिया समय (कुल) 225.66s 117.89s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Claude Opus 5

medium
लागत
$0.125
समय
69.3s
टोकन
5,134 tok

#16 GPT-6.1 Sol

low
लागत
$0.028
समय
44.6s
टोकन
2,881 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

त्वरित तुलना

तुलना जोड़ी बदलें