नेविगेशन
Advertise here

Mercury 2 vs Ling 3.0 Tiny (high)

Mercury 2 average score में आगे है: 4.4 vs 3.7. Ling 3.0 Tiny (high) की benchmark लागत कम है: $0.000 vs $0.033. Mercury 2 तेज है: 1.18s vs 72.24s, pass rates 23.2% vs 23.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#338
कुल आउटपुट टोकन
9,709
प्रतिक्रिया समय (औसत)
1.18s
कुल लागत
$0.033
रैंक
#354
कुल आउटपुट टोकन
950,683
प्रतिक्रिया समय (औसत)
72.24s
कुल लागत
$0.000
अनुशंसित मॉडल Mercury 2

It has the best score here (4.4), while responding about 61.2x faster than Ling 3.0 Tiny (high).

विस्तृत तुलना

मेट्रिक Mercury 2 Mercury 2 none रिलीज़: 2026-02-24 Ling 3.0 Tiny Ling 3.0 Tiny high रिलीज़: 2026-08-07
स्कोर 4.4 3.7
रैंक #338 #354
विश्वसनीयता 10.0 10.0
संगति 9.2 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 23.2% 23.2%
अस्थिर टेस्ट 2 3
कुल रन 69 69
प्रति परिणाम लागत 0.812 0.000
कुल लागत $0.033 $0.000
इनपुट कीमत $0.250 / 1M $0.000 / 1M
आउटपुट कीमत $0.750 / 1M $0.000 / 1M
कुल इनपुट टोकन 100,634 115,314
आउटपुट टोकन 9,709 133,965
रीजनिंग टोकन 0 816,718
प्रतिक्रिया समय (औसत) 1.18s 72.24s
प्रतिक्रिया समय (अधिकतम) 9.00s 345.15s
प्रतिक्रिया समय (कुल) 27.14s 1589.23s
पैरामीटर ~100B 7.9B कुल (1.3B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#338 Mercury 2

none
लागत
$0.002
समय
1.8s
टोकन
1,514 tok

#354 Ling 3.0 Tiny

high
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
169.5s
टोकन
5,252 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922

त्वरित तुलना

तुलना जोड़ी बदलें