नेविगेशन
Advertise here

Claude Opus 4.8 (low) vs Grok 4.7 (medium)

Grok 4.7 (medium) average score में आगे है: 7.3 vs 7.2. Grok 4.7 (medium) की benchmark लागत कम है: $3.501 vs $3.787. Claude Opus 4.8 (low) तेज है: 17.13s vs 117.65s, pass rates 78.3% vs 78.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#143
कुल आउटपुट टोकन
69,489
प्रतिक्रिया समय (औसत)
17.13s
कुल लागत
$3.787
रैंक
#134
कुल आउटपुट टोकन
474,745
प्रतिक्रिया समय (औसत)
117.65s
कुल लागत
$3.501
अनुशंसित मॉडल Claude Opus 4.8 (low)

Its score stays close to the best score here (7.2 vs 7.3), while responding about 6.9x faster than Grok 4.7 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 low रिलीज़: 2026-05-28 Grok 4.7 Grok 4.7 medium रिलीज़: 2026-09-21
स्कोर 7.2 7.3
रैंक #143 #134
विश्वसनीयता 10.0 9.8
संगति 8.6 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 78.3% 78.3%
अस्थिर टेस्ट 4 5
कुल रन 69 69
प्रति परिणाम लागत 23.669 19.582
कुल लागत $3.787 $3.501
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 409,947 326,066
आउटपुट टोकन 46,060 5,726
रीजनिंग टोकन 23,429 469,019
प्रतिक्रिया समय (औसत) 17.13s 117.65s
प्रतिक्रिया समय (अधिकतम) 127.97s 660.89s
प्रतिक्रिया समय (कुल) 394.01s 2706.03s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#143 Claude Opus 4.8

low
लागत
$0.031
समय
14.1s
टोकन
1,345 tok

#134 SpaceXAI: Grok 4.7

medium
लागत
$0.047
समय
132.3s
टोकन
9,954 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
Grok 4.7 6.6 4.6 77.8% 2 312.17s 10,266 349 172,347

त्वरित तुलना

तुलना जोड़ी बदलें