नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs xAI: Grok 4.5

Claude Opus 5 (low) average score में आगे है: 8.6 vs 8.3. Claude Opus 5 (low) की benchmark लागत कम है: $1.121 vs $1.928. Claude Opus 5 (low) तेज है: 6.99s vs 61.71s, pass rates 80.3% vs 78.8%.

अनुशंसित मॉडलClaude Opus 5 (low)It has the best score here (8.6), while costing about 1.7x less than Grok 4.5 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 low रिलीज़: 2026-07-25 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 8.6 8.3
रैंक #23 #28
विश्वसनीयता 10.0 10.0
संगति 9.3 8.9
सही परीक्षण
प्रति प्रयास पास दर 80.3% 78.8%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 6.593 12.049
कुल लागत $1.121 $1.928
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 134,773 122,146
आउटपुट टोकन 14,123 5,514
रीजनिंग टोकन 3,896 275,053
प्रतिक्रिया समय (औसत) 6.99s 61.71s
प्रतिक्रिया समय (अधिकतम) 30.67s 436.38s
प्रतिक्रिया समय (कुल) 153.73s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Claude Opus 5

low
लागत
$0.062
समय
30.2s
टोकन
2,615 tok

#28 xAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 7.8 7.4 77.8% 1 6.70s 10,590 2,442 760
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें