नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 (high) vs Grok 4.6 (high)

average score लगभग बराबर है: 9.2 vs 9.2. Grok 4.6 (high) की benchmark लागत कम है: $1.809 vs $2.835. Claude Opus 5 (high) तेज है: 20.44s vs 79.38s, pass rates 84.9% vs 84.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#10
कुल आउटपुट टोकन
86,180
प्रतिक्रिया समय (औसत)
20.44s
कुल लागत
$2.835
रैंक
#11
कुल आउटपुट टोकन
265,604
प्रतिक्रिया समय (औसत)
79.38s
कुल लागत
$1.809
अनुशंसित मॉडल Claude Opus 5 (high)

It has the best score here (9.2), while responding about 3.9x faster than Grok 4.6 (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 high रिलीज़: 2026-07-25 Grok 4.6 Grok 4.6 high रिलीज़: 2026-08-12
स्कोर 9.2 9.2
रैंक #10 #11
विश्वसनीयता 10.0 10.0
संगति 9.6 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 84.9% 84.9%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 15.747 10.046
कुल लागत $2.835 $1.809
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 135,959 107,266
आउटपुट टोकन 67,066 5,094
रीजनिंग टोकन 19,114 260,510
प्रतिक्रिया समय (औसत) 20.44s 79.38s
प्रतिक्रिया समय (अधिकतम) 159.01s 618.49s
प्रतिक्रिया समय (कुल) 449.68s 1746.29s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 Claude Opus 5

high
लागत
$0.265
समय
144.5s
टोकन
10,741 tok

#11 SpaceXAI: Grok 4.6

high
लागत
$0.107
समय
265.1s
टोकन
18,001 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829

त्वरित तुलना

तुलना जोड़ी बदलें