नेविगेशन
Advertise here

Mercury 2 vs Ling 3.0 Tiny (medium)

Mercury 2 average score में आगे है: 4.4 vs 3.6. Ling 3.0 Tiny (medium) की benchmark लागत कम है: $0.000 vs $0.033. Mercury 2 तेज है: 1.18s vs 64.99s, pass rates 23.2% vs 23.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#338
कुल आउटपुट टोकन
9,709
प्रतिक्रिया समय (औसत)
1.18s
कुल लागत
$0.033
रैंक
#356
कुल आउटपुट टोकन
923,276
प्रतिक्रिया समय (औसत)
64.99s
कुल लागत
$0.000
अनुशंसित मॉडल Mercury 2

It has the best score here (4.4), while responding about 55.1x faster than Ling 3.0 Tiny (medium).

विस्तृत तुलना

मेट्रिक Mercury 2 Mercury 2 none रिलीज़: 2026-02-24 Ling 3.0 Tiny Ling 3.0 Tiny medium रिलीज़: 2026-08-07
स्कोर 4.4 3.6
रैंक #338 #356
विश्वसनीयता 10.0 9.6
संगति 9.2 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 23.2% 23.2%
अस्थिर टेस्ट 2 3
कुल रन 69 69
प्रति परिणाम लागत 0.812 0.000
कुल लागत $0.033 $0.000
इनपुट कीमत $0.250 / 1M $0.000 / 1M
आउटपुट कीमत $0.750 / 1M $0.000 / 1M
कुल इनपुट टोकन 100,634 103,898
आउटपुट टोकन 9,709 148,304
रीजनिंग टोकन 0 774,972
प्रतिक्रिया समय (औसत) 1.18s 64.99s
प्रतिक्रिया समय (अधिकतम) 9.00s 262.20s
प्रतिक्रिया समय (कुल) 27.14s 1429.68s
पैरामीटर ~100B 7.9B कुल (1.3B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#338 Mercury 2

none
लागत
$0.002
समय
1.8s
टोकन
1,514 tok

#356 Ling 3.0 Tiny

medium
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
177.4s
टोकन
6,873 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006

त्वरित तुलना

तुलना जोड़ी बदलें