नेविगेशन
AI BENCHY
Advertise here

Mercury 2 vs Ling 3.0 Tiny (high)

Mercury 2 average score में आगे है: 4.6 vs 3.8. Ling 3.0 Tiny (high) की benchmark लागत कम है: $0.000 vs $0.030. Mercury 2 तेज है: 829ms vs 76.06s, pass rates 22.7% vs 24.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#224
कुल आउटपुट टोकन
9,564
प्रतिक्रिया समय (औसत)
829ms
कुल लागत
$0.030
रैंक
#240
कुल आउटपुट टोकन
1,048,987
प्रतिक्रिया समय (औसत)
76.06s
कुल लागत
$0.000
अनुशंसित मॉडल Mercury 2

It has the best score here (4.6), while responding about 91.7x faster than Ling 3.0 Tiny (high).

विस्तृत तुलना

मेट्रिक Mercury 2 Mercury 2 none रिलीज़: 2026-02-24 Ling 3.0 Tiny Ling 3.0 Tiny high रिलीज़: 2026-08-07 निःशुल्क उपलब्ध
स्कोर 4.6 3.8
रैंक #224 #240
विश्वसनीयता 10.0 10.0
संगति 9.2 8.8
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 22.7% 24.2%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 0.734 0.000
कुल लागत $0.030 $0.000
इनपुट कीमत $0.250 / 1M $0.000 / 1M
आउटपुट कीमत $0.750 / 1M $0.000 / 1M
कुल इनपुट टोकन 88,704 115,494
आउटपुट टोकन 9,564 139,569
रीजनिंग टोकन 0 909,418
प्रतिक्रिया समय (औसत) 829ms 76.06s
प्रतिक्रिया समय (अधिकतम) 4.52s 345.15s
प्रतिक्रिया समय (कुल) 18.24s 1673.38s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#224 Mercury 2

none
लागत
$0.002
समय
1.8s
टोकन
1,514 tok

#240 Ling 3.0 Tiny

high
अमान्य SVG
लागत
$0.000
समय
169.5s
टोकन
5,252 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922

त्वरित तुलना

तुलना जोड़ी बदलें