नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 5 (medium) vs Grok 4.6 (medium)

average score लगभग बराबर है: 8.3 vs 8.3. Claude Sonnet 5 (medium) की benchmark लागत कम है: $0.922 vs $1.656. Claude Sonnet 5 (medium) तेज है: 12.52s vs 71.86s, pass rates 80.3% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#41
कुल आउटपुट टोकन
63,207
प्रतिक्रिया समय (औसत)
12.52s
कुल लागत
$0.922
रैंक
#40
कुल आउटपुट टोकन
240,338
प्रतिक्रिया समय (औसत)
71.86s
कुल लागत
$1.656
अनुशंसित मॉडल Claude Sonnet 5 (medium)

It has the best score here (8.3), while costing about 1.8x less than Grok 4.6 (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5 Claude Sonnet 5 medium रिलीज़: 2026-06-30 Grok 4.6 Grok 4.6 medium रिलीज़: 2026-08-12
स्कोर 8.3 8.3
रैंक #41 #40
विश्वसनीयता 10.0 10.0
संगति 9.0 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 80.3% 80.3%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 5.760 11.038
कुल लागत $0.922 $1.656
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 145,956 106,778
आउटपुट टोकन 52,333 4,811
रीजनिंग टोकन 10,874 235,527
प्रतिक्रिया समय (औसत) 12.52s 71.86s
प्रतिक्रिया समय (अधिकतम) 66.71s 514.35s
प्रतिक्रिया समय (कुल) 275.42s 1580.96s
पैरामीटर ~1T कुल (~100B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 Claude Sonnet 5

medium
लागत
$0.007
समय
6.4s
टोकन
832 tok

#40 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

त्वरित तुलना

तुलना जोड़ी बदलें