नेविगेशन
Advertise here

Claude Opus 5.5 (high) vs Grok 4.6 (high)

Grok 4.6 (high) average score में आगे है: 9.3 vs 9.3. Claude Opus 5.5 (high) की benchmark लागत कम है: $1.266 vs $1.908. Claude Opus 5.5 (high) तेज है: 25.88s vs 84.15s, pass rates 86.4% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#21
कुल आउटपुट टोकन
36,457
प्रतिक्रिया समय (औसत)
25.88s
कुल लागत
$1.266
रैंक
#19
कुल आउटपुट टोकन
282,217
प्रतिक्रिया समय (औसत)
84.15s
कुल लागत
$1.908
अनुशंसित मॉडल Claude Opus 5.5 (high)

Its score stays close to the best score here (9.3 vs 9.3), while costing about 1.5x less than Grok 4.6 (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 high रिलीज़: 2026-09-23 Grok 4.6 Grok 4.6 high रिलीज़: 2026-08-12
स्कोर 9.3 9.3
रैंक #21 #19
विश्वसनीयता 10.0 10.0
संगति 9.3 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 86.4%
अस्थिर टेस्ट 2 0
कुल रन 66 66
प्रति परिणाम लागत 7.029 10.042
कुल लागत $1.266 $1.908
इनपुट कीमत $4.000 / 1M $2.000 / 1M
आउटपुट कीमत $20.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 134,020 107,275
आउटपुट टोकन 7,237 5,094
रीजनिंग टोकन 29,220 277,123
प्रतिक्रिया समय (औसत) 25.88s 84.15s
प्रतिक्रिया समय (अधिकतम) 95.95s 618.49s
प्रतिक्रिया समय (कुल) 569.33s 1851.26s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Claude Opus 5.5

high
लागत
$0.136
समय
75.6s
टोकन
6,934 tok

#19 SpaceXAI: Grok 4.6

high
लागत
$0.107
समय
265.1s
टोकन
18,001 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5.5 10.0 10.0 100.0% 0 13.44s 10,608 584 5,042
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829

त्वरित तुलना

तुलना जोड़ी बदलें