नेविगेशन
Advertise here

Command A+ (medium) vs Grok 4.20

average score लगभग बराबर है: 3.4 vs 3.4. Grok 4.20 की benchmark लागत कम है: $0.057 vs $0.064. Grok 4.20 तेज है: 1.11s vs 91.72s, pass rates 0.0% vs 26.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#363
कुल आउटपुट टोकन
18,795
प्रतिक्रिया समय (औसत)
91.72s
कुल लागत
$0.064
रैंक
#362
कुल आउटपुट टोकन
1,923
प्रतिक्रिया समय (औसत)
1.11s
कुल लागत
$0.057
अनुशंसित मॉडल Grok 4.20

It has the best score here (3.4), while responding about 82.7x faster than Command A+ (medium).

विस्तृत तुलना

मेट्रिक Command A+ Command A+ medium रिलीज़: 2026-09-23 Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31
स्कोर 3.4 3.4
रैंक #363 #362
विश्वसनीयता 3.5 लागू नहीं
संगति 10.0 7.8
प्रयास 69/69 54/69
सही परीक्षण
प्रति प्रयास पास दर 0.0% 26.1%
अस्थिर टेस्ट 0 0
कुल रन 69 54
प्रति परिणाम लागत 0.000 1.570
कुल लागत $0.064 $0.057
इनपुट कीमत $0.300 / 1M $1.250 / 1M
आउटपुट कीमत $1.500 / 1M $2.500 / 1M
कुल इनपुट टोकन 118,771 41,313
आउटपुट टोकन 4,127 1,923
रीजनिंग टोकन 14,668 0
प्रतिक्रिया समय (औसत) 91.72s 1.11s
प्रतिक्रिया समय (अधिकतम) 112.76s 6.04s
प्रतिक्रिया समय (कुल) 2109.54s 19.96s
पैरामीटर 218B कुल (25B सक्रिय) ~1T कुल (~100B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#363 Command A+

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#362 xAI: Grok 4.20

none
लागत
$0.004
समय
6.5s
टोकन
1,367 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Command A+ 3.0 10.0 0.0% 0 93.13s 0 0 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

त्वरित तुलना

तुलना जोड़ी बदलें