नेविगेशन
Advertise here

Ember-1 vs Laguna S 2.1 (high)

Laguna S 2.1 (high) average score में आगे है: 5.4 vs 5.2. Laguna S 2.1 (high) की benchmark लागत कम है: $0.114 vs $0.123. Ember-1 तेज है: 19.46s vs 111.60s, pass rates 42.4% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#297
कुल आउटपुट टोकन
2,664
प्रतिक्रिया समय (औसत)
19.46s
कुल लागत
$0.123
रैंक
#288
कुल आउटपुट टोकन
584,864
प्रतिक्रिया समय (औसत)
111.60s
कुल लागत
$0.114
अनुशंसित मॉडल Ember-1

Its score stays close to the best score here (5.2 vs 5.4), while responding about 5.7x faster than Laguna S 2.1 (high).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 none रिलीज़: 2026-09-28 Laguna S 2.1 Laguna S 2.1 high रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.2 5.4
रैंक #297 #288
विश्वसनीयता 8.1 10.0
संगति 8.9 8.1
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 42.4% 27.3%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 1.528 3.153
कुल लागत $0.123 $0.114
इनपुट कीमत $3.000 / 1M $0.090 / 1M
आउटपुट कीमत $15.000 / 1M $0.180 / 1M
कुल इनपुट टोकन 27,426 208,937
आउटपुट टोकन 2,664 175,588
रीजनिंग टोकन 0 409,276
प्रतिक्रिया समय (औसत) 19.46s 111.60s
प्रतिक्रिया समय (अधिकतम) 93.12s 1190.11s
प्रतिक्रिया समय (कुल) 428.04s 2455.24s
पैरामीटर ~2.8T कुल (~104B सक्रिय) 118B कुल (8B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#297 Ember-1

none
लागत
$0.156
समय
224.6s
टोकन
10,555 tok

#288 Laguna S 2.1

high
लागत
$0.001
समय
6.8s
टोकन
1,389 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 5.5 10.0 33.3% 0 1.94s 7,485 393 0
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009

त्वरित तुलना

तुलना जोड़ी बदलें