नेविगेशन
Advertise here

Ember-1 (low) vs Qwen3.5-122B-A10B (medium)

average score लगभग बराबर है: 7.0 vs 7.0. Qwen3.5-122B-A10B (medium) की benchmark लागत कम है: $1.152 vs $1.488. Ember-1 (low) तेज है: 34.90s vs 66.96s, pass rates 65.2% vs 71.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#157
कुल आउटपुट टोकन
56,766
प्रतिक्रिया समय (औसत)
34.90s
कुल लागत
$1.488
रैंक
#158
कुल आउटपुट टोकन
522,190
प्रतिक्रिया समय (औसत)
66.96s
कुल लागत
$1.152
अनुशंसित मॉडल Ember-1 (low)

It has the best score here (7.0), while responding about 1.9x faster than Qwen3.5-122B-A10B (medium).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 low रिलीज़: 2026-09-28 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium रिलीज़: 2026-02-24
स्कोर 7.0 7.0
रैंक #157 #158
विश्वसनीयता 8.8 10.0
संगति 8.2 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 71.0%
अस्थिर टेस्ट 5 5
कुल रन 69 69
प्रति परिणाम लागत 11.441 9.196
कुल लागत $1.488 $1.152
इनपुट कीमत $3.000 / 1M $0.260 / 1M
आउटपुट कीमत $15.000 / 1M $2.080 / 1M
कुल इनपुट टोकन 211,908 251,695
आउटपुट टोकन 14,158 49,415
रीजनिंग टोकन 42,608 472,775
प्रतिक्रिया समय (औसत) 34.90s 66.96s
प्रतिक्रिया समय (अधिकतम) 121.29s 519.30s
प्रतिक्रिया समय (कुल) 802.79s 1539.99s
पैरामीटर ~2.8T कुल (~104B सक्रिय) 122B कुल (10B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Ember-1

low
लागत
$0.016
समय
24.2s
टोकन
1,165 tok

#158 Qwen3.5-122B-A10B

medium
लागत
$0.019
समय
48.7s
टोकन
6,034 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

त्वरित तुलना

तुलना जोड़ी बदलें