नेविगेशन
Advertise here

Ember-1 (high) vs Gemma 4 31B (medium)

average score लगभग बराबर है: 6.9 vs 6.9. Gemma 4 31B (medium) की benchmark लागत कम है: $0.117 vs $2.405. Ember-1 (high) तेज है: 58.14s vs 78.76s, pass rates 71.0% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#164
कुल आउटपुट टोकन
121,223
प्रतिक्रिया समय (औसत)
58.14s
कुल लागत
$2.405
रैंक
#165
कुल आउटपुट टोकन
277,315
प्रतिक्रिया समय (औसत)
78.76s
कुल लागत
$0.117
अनुशंसित मॉडल Gemma 4 31B (medium)

It has the best score here (6.9), while costing about 20.6x less than Ember-1 (high).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 high रिलीज़: 2026-09-28 Gemma 4 31B Gemma 4 31B medium रिलीज़: 2026-04-02 निःशुल्क उपलब्ध
स्कोर 6.9 6.9
रैंक #164 #165
विश्वसनीयता 8.6 10.0
संगति 7.2 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 71.0% 66.7%
अस्थिर टेस्ट 8 3
कुल रन 69 69
प्रति परिणाम लागत 20.041 1.195
कुल लागत $2.405 $0.117
इनपुट कीमत $3.000 / 1M $0.090 / 1M
आउटपुट कीमत $15.000 / 1M $0.340 / 1M
कुल इनपुट टोकन 195,489 251,164
आउटपुट टोकन 12,475 36,112
रीजनिंग टोकन 108,748 241,203
प्रतिक्रिया समय (औसत) 58.14s 78.76s
प्रतिक्रिया समय (अधिकतम) 255.06s 437.40s
प्रतिक्रिया समय (कुल) 1337.19s 1653.96s
पैरामीटर ~2.8T कुल (~104B सक्रिय) 30.7B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Ember-1

high
लागत
$0.038
समय
55.1s
टोकन
2,671 tok

#165 Gemma 4 31B

medium
लागत
$0.002
समय
45.7s
टोकन
2,696 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212

त्वरित तुलना

तुलना जोड़ी बदलें