नेविगेशन
Advertise here

Ember-1 vs Granite 4.2 8B (medium)

average score लगभग बराबर है: 5.2 vs 5.2. Granite 4.2 8B (medium) की benchmark लागत कम है: $0.008 vs $0.123. Ember-1 तेज है: 19.46s vs 45.97s, pass rates 42.4% vs 34.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#297
कुल आउटपुट टोकन
2,664
प्रतिक्रिया समय (औसत)
19.46s
कुल लागत
$0.123
रैंक
#298
कुल आउटपुट टोकन
19,330
प्रतिक्रिया समय (औसत)
45.97s
कुल लागत
$0.008
अनुशंसित मॉडल Granite 4.2 8B (medium)

It has the best score here (5.2), while costing about 15.3x less than Ember-1.

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 none रिलीज़: 2026-09-28 Granite 4.2 8B Granite 4.2 8B medium रिलीज़: 2026-09-02
स्कोर 5.2 5.2
रैंक #297 #298
विश्वसनीयता 8.1 8.7
संगति 8.9 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 42.4% 34.9%
अस्थिर टेस्ट 3 1
कुल रन 66 66
प्रति परिणाम लागत 1.528 0.117
कुल लागत $0.123 $0.008
इनपुट कीमत $3.000 / 1M $0.060 / 1M
आउटपुट कीमत $15.000 / 1M $0.250 / 1M
कुल इनपुट टोकन 27,426 52,909
आउटपुट टोकन 2,664 7,058
रीजनिंग टोकन 0 12,272
प्रतिक्रिया समय (औसत) 19.46s 45.97s
प्रतिक्रिया समय (अधिकतम) 93.12s 557.96s
प्रतिक्रिया समय (कुल) 428.04s 1011.42s
पैरामीटर ~2.8T कुल (~104B सक्रिय) 8B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#297 Ember-1

none
लागत
$0.156
समय
224.6s
टोकन
10,555 tok

#298 IBM: Granite 4.2 8B

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 5.5 10.0 33.3% 0 1.94s 7,485 393 0
Granite 4.2 8B 5.5 10.0 33.3% 0 12.09s 8,439 2,445 3,900

त्वरित तुलना

तुलना जोड़ी बदलें