नेविगेशन
AI BENCHY
Advertise here

Mercury 2 vs Ling 3.0 Tiny (low)

Mercury 2 average score में आगे है: 4.6 vs 3.8. Ling 3.0 Tiny (low) की benchmark लागत कम है: $0.000 vs $0.030. Mercury 2 तेज है: 829ms vs 66.85s, pass rates 22.7% vs 19.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#224
कुल आउटपुट टोकन
9,564
प्रतिक्रिया समय (औसत)
829ms
कुल लागत
$0.030
रैंक
#241
कुल आउटपुट टोकन
977,836
प्रतिक्रिया समय (औसत)
66.85s
कुल लागत
$0.000
अनुशंसित मॉडल Mercury 2

It has the best score here (4.6), while responding about 80.6x faster than Ling 3.0 Tiny (low).

विस्तृत तुलना

मेट्रिक Mercury 2 Mercury 2 none रिलीज़: 2026-02-24 Ling 3.0 Tiny Ling 3.0 Tiny low रिलीज़: 2026-08-07 निःशुल्क उपलब्ध
स्कोर 4.6 3.8
रैंक #224 #241
विश्वसनीयता 10.0 9.7
संगति 9.2 9.7
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 22.7% 19.7%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 0.734 0.000
कुल लागत $0.030 $0.000
इनपुट कीमत $0.250 / 1M $0.000 / 1M
आउटपुट कीमत $0.750 / 1M $0.000 / 1M
कुल इनपुट टोकन 88,704 99,842
आउटपुट टोकन 9,564 152,159
रीजनिंग टोकन 0 825,677
प्रतिक्रिया समय (औसत) 829ms 66.85s
प्रतिक्रिया समय (अधिकतम) 4.52s 252.08s
प्रतिक्रिया समय (कुल) 18.24s 1470.69s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#224 Mercury 2

none
लागत
$0.002
समय
1.8s
टोकन
1,514 tok

#241 Ling 3.0 Tiny

low
अमान्य SVG
लागत
$0.000
समय
200.0s
टोकन
5,030 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
Ling 3.0 Tiny 2.9 10.0 0.0% 0 170.73s 7,619 56,012 170,220

त्वरित तुलना

तुलना जोड़ी बदलें