AI BENCHY तुलना

Anthropic: Claude Sonnet 4.6 vs xAI: Grok 4.20

सारांश

Claude Sonnet 4.6 vs Grok 4.20 benchmark तुलना: average score लगभग बराबर है: 7.3 vs 7.3. Claude Sonnet 4.6 की benchmark लागत कम है: $0.316 vs $0.609. Claude Sonnet 4.6 तेज है: 5.04s vs 27.68s, pass rates 55.6% vs 63.5%.

अनुशंसित मॉडल: Claude Sonnet 4.6 - It has the best score here (7.3), while costing about 1.9x less than Grok 4.20.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक	Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17	Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31

मेट्रिक	Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17	Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर	7.3	7.3
रैंक	#57	#55
विश्वसनीयता	10.0	10.0
संगति	9.7	8.8
सही परीक्षण
प्रति प्रयास पास दर	55.6%	63.5%
अस्थिर टेस्ट	1	3
कुल रन	63	63
प्रति परिणाम लागत	2.870	8.309
कुल लागत	$0.316	$0.609
इनपुट कीमत	$3.000 / 1M	$1.250 / 1M
आउटपुट कीमत	$15.000 / 1M	$2.500 / 1M
कुल इनपुट टोकन	57,886	44,433
आउटपुट टोकन	9,465	1,819
रीजनिंग टोकन	0	219,524
प्रतिक्रिया समय (औसत)	5.04s	27.68s
प्रतिक्रिया समय (अधिकतम)	23.84s	199.66s
प्रतिक्रिया समय (कुल)	70.60s	581.26s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 Claude Sonnet 4.6

none

लागत: $0.038
समय: 27.3s
टोकन: 2,598 tok

#55 xAI: Grok 4.20

medium

लागत: $0.041
समय: 110.3s
टोकन: 16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	4.8	10.0	25.0%	0		2.94s	636	1,214	0
Grok 4.20	8.2	7.9	83.3%	1		3.95s	2,010	287	8,312

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	5.5	10.0	33.3%	0		5.19s	8,522	2,127	0
Grok 4.20	6.3	6.6	55.6%	1		109.93s	8,307	268	103,150

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	9.5	10.0	100.0%	0		23.84s	26,024	3,766	0
Grok 4.20	10.0	10.0	100.0%	0		17.40s	12,909	232	9,556

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	10.0	10.0	100.0%	0		3.43s	8,574	252	0
Grok 4.20	10.0	10.0	100.0%	0		4.17s	7,761	180	5,333

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	7.7	10.0	66.7%	0		3.54s	759	413	0
Grok 4.20	5.3	10.0	33.3%	0		27.03s	1,764	375	49,339

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	6.1	3.1	66.7%	1		2.56s	513	192	0
Grok 4.20	3.9	2.6	33.3%	1		24.48s	825	65	6,440

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	6.5	10.0	50.0%	0		1.96s	690	90	0
Grok 4.20	9.8	10.0	100.0%	0		4.26s	1,362	57	6,419

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	7.7	10.0	66.7%	0		2.53s	663	533	0
Grok 4.20	7.7	10.0	66.7%	0		6.22s	1,689	149	7,913

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	11,301	447	0
Grok 4.20	3.0	10.0	0.0%	0		13.68s	7,275	197	6,620

सामान्य ज्ञान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	3.0	10.0	0.0%	0		4.67s	204	431	0
Grok 4.20	3.0	10.0	0.0%	0		63.48s	531	9	16,442

त्वरित तुलना

तुलना जोड़ी बदलें

Gemini 3 Flash PreviewlowvsGrok 4.20medium Claude Sonnet 4.6nonevsGemini 3 Flash Previewlow Claude Sonnet 4.6nonevsMiMo-V2.5-Promedium Claude Sonnet 4.6nonevsSeed-2.0-Minimedium Claude Opus 4.8nonevsGrok 4.20medium Claude Sonnet 4.6nonevsGemma 4 26B A4Bmediumनिःशुल्क उपलब्ध Claude Sonnet 4.6nonevsDeepSeek V3.2medium Claude Sonnet 4.6nonevsQwen3.6 Flashmedium GPT-5.3 ChatnonevsGrok 4.20medium DeepSeek V4 PrononevsGrok 4.20medium Qwen3.7 PlusnonevsGrok 4.20medium Claude Sonnet 4.6nonevsGPT-5.4 Nanomedium