नेविगेशन
Advertise here

Claude Opus 5 (high) vs Grok 4.6 (high)

Grok 4.6 (high) average score में आगे है: 9.3 vs 9.2. Grok 4.6 (high) की benchmark लागत कम है: $1.908 vs $3.070. Claude Opus 5 (high) तेज है: 22.51s vs 84.15s, pass rates 81.8% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#24
कुल आउटपुट टोकन
95,583
प्रतिक्रिया समय (औसत)
22.51s
कुल लागत
$3.070
रैंक
#19
कुल आउटपुट टोकन
282,217
प्रतिक्रिया समय (औसत)
84.15s
कुल लागत
$1.908
अनुशंसित मॉडल Claude Opus 5 (high)

Its score stays close to the best score here (9.2 vs 9.3), while responding about 3.7x faster than Grok 4.6 (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 high रिलीज़: 2026-07-25 Grok 4.6 Grok 4.6 high रिलीज़: 2026-08-12
स्कोर 9.2 9.3
रैंक #24 #19
विश्वसनीयता 10.0 10.0
संगति 10.0 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 86.4%
अस्थिर टेस्ट 0 0
कुल रन 66 66
प्रति परिणाम लागत 17.052 10.042
कुल लागत $3.070 $1.908
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 135,956 107,275
आउटपुट टोकन 64,624 5,094
रीजनिंग टोकन 30,959 277,123
प्रतिक्रिया समय (औसत) 22.51s 84.15s
प्रतिक्रिया समय (अधिकतम) 159.01s 618.49s
प्रतिक्रिया समय (कुल) 495.12s 1851.26s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#24 Claude Opus 5

high
लागत
$0.265
समय
144.5s
टोकन
10,741 tok

#19 SpaceXAI: Grok 4.6

high
लागत
$0.107
समय
265.1s
टोकन
18,001 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829

त्वरित तुलना

तुलना जोड़ी बदलें