नेविगेशन
Advertise here

Space Bunny Alpha (high) vs Grok 4.20 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. Space Bunny Alpha (high) की benchmark लागत कम है: $0.000 vs $0.805. Space Bunny Alpha (high) तेज है: 27.38s vs 32.56s, pass rates 62.1% vs 60.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#161
कुल आउटपुट टोकन
170,155
प्रतिक्रिया समय (औसत)
27.38s
कुल लागत
$0.000
रैंक
#165
कुल आउटपुट टोकन
270,259
प्रतिक्रिया समय (औसत)
32.56s
कुल लागत
$0.805
अनुशंसित मॉडल Grok 4.20 (medium)

It has the strongest score in this comparison (7.0) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Space Bunny Alpha Space Bunny Alpha high रिलीज़: 2026-09-24 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 7.0 7.0
रैंक #161 #165
विश्वसनीयता 10.0 10.0
संगति 8.5 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 60.6%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 0.000 10.365
कुल लागत $0.000 $0.805
इनपुट कीमत $0.000 / 1M $1.250 / 1M
आउटपुट कीमत $0.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 137,409 102,986
आउटपुट टोकन 170,155 5,860
रीजनिंग टोकन 0 264,399
प्रतिक्रिया समय (औसत) 27.38s 32.56s
प्रतिक्रिया समय (अधिकतम) 234.56s 199.66s
प्रतिक्रिया समय (कुल) 602.37s 716.36s
पैरामीटर - ~1T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#161 Space Bunny Alpha

high
लागत
$0.000
समय
76.4s
टोकन
8,935 tok

#165 SpaceXAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Space Bunny Alpha 6.2 7.1 55.6% 1 8.29s 8,493 8,006 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

त्वरित तुलना

तुलना जोड़ी बदलें