नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs xAI: Grok 4.5

Claude Opus 5 (low) average score में आगे है: 8.6 vs 8.4. Grok 4.5 (low) की benchmark लागत कम है: $0.935 vs $1.121. Claude Opus 5 (low) तेज है: 6.99s vs 15.56s, pass rates 80.3% vs 75.8%.

अनुशंसित मॉडलClaude Opus 5 (low)It has the best score here (8.6), while responding about 2.2x faster than Grok 4.5 (low).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 low रिलीज़: 2026-07-25 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 8.6 8.4
रैंक #23 #26
विश्वसनीयता 10.0 10.0
संगति 9.3 9.7
सही परीक्षण
प्रति प्रयास पास दर 80.3% 75.8%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 6.593 5.844
कुल लागत $1.121 $0.935
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 134,773 125,596
आउटपुट टोकन 14,123 7,505
रीजनिंग टोकन 3,896 106,446
प्रतिक्रिया समय (औसत) 6.99s 15.56s
प्रतिक्रिया समय (अधिकतम) 30.67s 205.28s
प्रतिक्रिया समय (कुल) 153.73s 342.32s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Claude Opus 5

low
लागत
$0.062
समय
30.2s
टोकन
2,615 tok

#26 xAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 7.8 7.4 77.8% 1 6.70s 10,590 2,442 760
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें