नेविगेशन
Advertise here

Claude Opus 5 vs Grok 4.7 (high)

Claude Opus 5 average score में आगे है: 7.5 vs 7.5. Claude Opus 5 की benchmark लागत कम है: $1.550 vs $2.180. Claude Opus 5 तेज है: 7.65s vs 113.10s, pass rates 57.6% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#106
कुल आउटपुट टोकन
24,866
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$1.550
रैंक
#110
कुल आउटपुट टोकन
416,086
प्रतिक्रिया समय (औसत)
113.10s
कुल लागत
$2.180
अनुशंसित मॉडल Claude Opus 5

It has the best score here (7.5), while responding about 14.8x faster than Grok 4.7 (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 Grok 4.7 Grok 4.7 high रिलीज़: 2026-09-21
स्कोर 7.5 7.5
रैंक #106 #110
विश्वसनीयता 10.0 9.5
संगति 9.6 7.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 75.8%
अस्थिर टेस्ट 1 7
कुल रन 66 66
प्रति परिणाम लागत 12.912 16.765
कुल लागत $1.550 $2.180
इनपुट कीमत $5.000 / 1M $1.600 / 1M
आउटपुट कीमत $25.000 / 1M $4.800 / 1M
कुल इनपुट टोकन 185,547 113,892
आउटपुट टोकन 24,866 6,907
रीजनिंग टोकन 0 409,179
प्रतिक्रिया समय (औसत) 7.65s 113.10s
प्रतिक्रिया समय (अधिकतम) 47.72s 573.57s
प्रतिक्रिया समय (कुल) 168.35s 2488.20s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#110 SpaceXAI: Grok 4.7

high
लागत
$0.110
समय
301.3s
टोकन
23,143 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

त्वरित तुलना

तुलना जोड़ी बदलें