नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs xAI: Grok 4.5

Claude Opus 5 (medium) average score में आगे है: 9.2 vs 8.9. Claude Opus 5 (medium) की benchmark लागत कम है: $1.486 vs $1.707. Claude Opus 5 (medium) तेज है: 9.38s vs 76.50s, pass rates 83.3% vs 83.3%.

अनुशंसित मॉडलClaude Opus 5 (medium)It has the best score here (9.2), while responding about 8.2x faster than Grok 4.5 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 medium रिलीज़: 2026-07-25 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 9.2 8.9
रैंक #12 #17
विश्वसनीयता 10.0 10.0
संगति 9.6 9.2
सही परीक्षण
प्रति प्रयास पास दर 83.3% 83.3%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 8.253 10.041
कुल लागत $1.486 $1.707
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 135,607 151,562
आउटपुट टोकन 25,673 5,655
रीजनिंग टोकन 6,930 247,540
प्रतिक्रिया समय (औसत) 9.38s 76.50s
प्रतिक्रिया समय (अधिकतम) 35.05s 676.83s
प्रतिक्रिया समय (कुल) 206.26s 1683.07s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
लागत
$0.125
समय
69.3s
टोकन
5,134 tok

#17 xAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें