नेविगेशन
Advertise here

Claude Opus 5 (medium) vs Grok 4.5 (high)

Claude Opus 5 (medium) average score में आगे है: 9.2 vs 9.0. Claude Opus 5 (medium) की benchmark लागत कम है: $1.586 vs $2.252. Claude Opus 5 (medium) तेज है: 10.26s vs 72.30s, pass rates 83.3% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-07

तुलना किए गए मॉडल

रैंक
#21
कुल आउटपुट टोकन
36,618
प्रतिक्रिया समय (औसत)
10.26s
कुल लागत
$1.586
रैंक
#30
कुल आउटपुट टोकन
324,462
प्रतिक्रिया समय (औसत)
72.30s
कुल लागत
$2.252
अनुशंसित मॉडल Claude Opus 5 (medium)

It has the best score here (9.2), while responding about 7.0x faster than Grok 4.5 (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 medium रिलीज़: 2026-07-25 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 9.2 9.0
रैंक #21 #30
विश्वसनीयता 10.0 10.0
संगति 9.6 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 86.4%
अस्थिर टेस्ट 1 3
कुल रन 66 66
प्रति परिणाम लागत 8.811 12.565
कुल लागत $1.586 $2.252
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 135,604 152,175
आउटपुट टोकन 23,814 5,655
रीजनिंग टोकन 12,804 318,807
प्रतिक्रिया समय (औसत) 10.26s 72.30s
प्रतिक्रिया समय (अधिकतम) 35.43s 676.83s
प्रतिक्रिया समय (कुल) 225.66s 1590.56s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Claude Opus 5

medium
लागत
$0.125
समय
69.3s
टोकन
5,134 tok

#30 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें