नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 4.6 vs Grok 4.6 (low)

average score लगभग बराबर है: 7.3 vs 7.4. Grok 4.6 (low) की benchmark लागत कम है: $0.441 vs $0.661. Claude Sonnet 4.6 तेज है: 8.12s vs 14.20s, pass rates 57.6% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#92
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
8.12s
कुल लागत
$0.661
रैंक
#90
कुल आउटपुट टोकन
36,792
प्रतिक्रिया समय (औसत)
14.20s
कुल लागत
$0.441
अनुशंसित मॉडल Grok 4.6 (low)

It has the strongest score in this comparison (7.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12
स्कोर 7.3 7.4
रैंक #92 #90
विश्वसनीयता 10.0 10.0
संगति 9.7 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 71.2%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 5.502 2.938
कुल लागत $0.661 $0.441
इनपुट कीमत $3.000 / 1M $2.000 / 1M
आउटपुट कीमत $15.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 123,264 109,951
आउटपुट टोकन 19,362 5,124
रीजनिंग टोकन 0 31,668
प्रतिक्रिया समय (औसत) 8.12s 14.20s
प्रतिक्रिया समय (अधिकतम) 51.18s 26.46s
प्रतिक्रिया समय (कुल) 121.78s 312.33s
पैरामीटर ~1T कुल (~100B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#90 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

त्वरित तुलना

तुलना जोड़ी बदलें