नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 4.6 vs Grok 4.20 (medium)

Claude Sonnet 4.6 average score में आगे है: 7.3 vs 7.0. Claude Sonnet 4.6 की benchmark लागत कम है: $0.661 vs $0.805. Claude Sonnet 4.6 तेज है: 7.67s vs 32.56s, pass rates 57.6% vs 60.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#98
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
7.67s
कुल लागत
$0.661
रैंक
#121
कुल आउटपुट टोकन
270,259
प्रतिक्रिया समय (औसत)
32.56s
कुल लागत
$0.805
अनुशंसित मॉडल Claude Sonnet 4.6

It has the best score here (7.3), while responding about 4.2x faster than Grok 4.20 (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 7.3 7.0
रैंक #98 #121
विश्वसनीयता 10.0 10.0
संगति 9.7 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 60.6%
अस्थिर टेस्ट 1 5
कुल रन 66 66
प्रति परिणाम लागत 5.503 10.365
कुल लागत $0.661 $0.805
इनपुट कीमत $3.000 / 1M $1.250 / 1M
आउटपुट कीमत $15.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 123,273 102,986
आउटपुट टोकन 19,362 5,860
रीजनिंग टोकन 0 264,399
प्रतिक्रिया समय (औसत) 7.67s 32.56s
प्रतिक्रिया समय (अधिकतम) 51.18s 199.66s
प्रतिक्रिया समय (कुल) 122.78s 716.36s
पैरामीटर ~1T कुल (~100B सक्रिय) ~1T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#121 SpaceXAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

त्वरित तुलना

तुलना जोड़ी बदलें