नेविगेशन
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 5 vs xAI: Grok 4.5

average score लगभग बराबर है: 8.3 vs 8.3. Claude Sonnet 5 (medium) की benchmark लागत कम है: $0.922 vs $1.928. Claude Sonnet 5 (medium) तेज है: 12.52s vs 61.71s, pass rates 80.3% vs 78.8%.

अनुशंसित मॉडलClaude Sonnet 5 (medium)It has the best score here (8.3), while costing about 2.1x less than Grok 4.5 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Sonnet 5 Claude Sonnet 5 medium रिलीज़: 2026-06-30 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 8.3 8.3
रैंक #29 #28
विश्वसनीयता 10.0 10.0
संगति 9.0 8.9
सही परीक्षण
प्रति प्रयास पास दर 80.3% 78.8%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 5.760 12.049
कुल लागत $0.922 $1.928
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 145,956 122,146
आउटपुट टोकन 52,333 5,514
रीजनिंग टोकन 10,874 275,053
प्रतिक्रिया समय (औसत) 12.52s 61.71s
प्रतिक्रिया समय (अधिकतम) 66.71s 436.38s
प्रतिक्रिया समय (कुल) 275.42s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Sonnet 5

medium
लागत
$0.007
समय
6.4s
टोकन
832 tok

#28 xAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें