नेविगेशन
Advertise here

Ember-1 (low) vs Gemma 4 31B (medium)

Ember-1 (low) average score में आगे है: 7.0 vs 6.9. Gemma 4 31B (medium) की benchmark लागत कम है: $0.117 vs $1.488. Ember-1 (low) तेज है: 34.90s vs 78.76s, pass rates 65.2% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#157
कुल आउटपुट टोकन
56,766
प्रतिक्रिया समय (औसत)
34.90s
कुल लागत
$1.488
रैंक
#164
कुल आउटपुट टोकन
277,315
प्रतिक्रिया समय (औसत)
78.76s
कुल लागत
$0.117
अनुशंसित मॉडल Gemma 4 31B (medium)

Its score stays close to the best score here (6.9 vs 7.0), while costing about 12.7x less than Ember-1 (low).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 low रिलीज़: 2026-09-28 Gemma 4 31B Gemma 4 31B medium रिलीज़: 2026-04-02 निःशुल्क उपलब्ध
स्कोर 7.0 6.9
रैंक #157 #164
विश्वसनीयता 8.8 10.0
संगति 8.2 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 66.7%
अस्थिर टेस्ट 5 3
कुल रन 69 69
प्रति परिणाम लागत 11.441 1.195
कुल लागत $1.488 $0.117
इनपुट कीमत $3.000 / 1M $0.090 / 1M
आउटपुट कीमत $15.000 / 1M $0.340 / 1M
कुल इनपुट टोकन 211,908 251,164
आउटपुट टोकन 14,158 36,112
रीजनिंग टोकन 42,608 241,203
प्रतिक्रिया समय (औसत) 34.90s 78.76s
प्रतिक्रिया समय (अधिकतम) 121.29s 437.40s
प्रतिक्रिया समय (कुल) 802.79s 1653.96s
पैरामीटर ~2.8T कुल (~104B सक्रिय) 30.7B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Ember-1

low
लागत
$0.016
समय
24.2s
टोकन
1,165 tok

#164 Gemma 4 31B

medium
लागत
$0.002
समय
45.7s
टोकन
2,696 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212

त्वरित तुलना

तुलना जोड़ी बदलें