नेविगेशन
Advertise here

Mercury 2.5 vs Ling 3.0 Tiny

Ling 3.0 Tiny average score में आगे है: 4.0 vs 3.9. Ling 3.0 Tiny की benchmark लागत कम है: $0.000 vs $0.016. Mercury 2.5 तेज है: 2.45s vs 14.02s, pass rates 25.8% vs 9.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#312
कुल आउटपुट टोकन
71,143
प्रतिक्रिया समय (औसत)
2.45s
कुल लागत
$0.016
रैंक
#308
कुल आउटपुट टोकन
110,071
प्रतिक्रिया समय (औसत)
14.02s
कुल लागत
$0.000
अनुशंसित मॉडल Mercury 2.5

Its score stays close to the best score here (3.9 vs 4.0), while responding about 5.7x faster than Ling 3.0 Tiny.

विस्तृत तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 none रिलीज़: 2026-09-08 Ling 3.0 Tiny Ling 3.0 Tiny none रिलीज़: 2026-08-07
स्कोर 3.9 4.0
रैंक #312 #308
विश्वसनीयता 10.0 9.8
संगति 7.5 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 25.8% 9.1%
अस्थिर टेस्ट 7 0
कुल रन 66 66
प्रति परिणाम लागत 0.782 0.000
कुल लागत $0.016 $0.000
इनपुट कीमत $0.040 / 1M $0.000 / 1M
आउटपुट कीमत $0.150 / 1M $0.000 / 1M
कुल इनपुट टोकन 123,740 184,579
आउटपुट टोकन 71,143 110,071
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 2.45s 14.02s
प्रतिक्रिया समय (अधिकतम) 36.48s 240.61s
प्रतिक्रिया समय (कुल) 53.83s 294.46s
पैरामीटर ~100B 7.9B कुल (1.3B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#312 Mercury 2.5

none
लागत
$0.001
समय
2.7s
टोकन
2,749 tok

#308 Ling 3.0 Tiny

none
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
334.1s
टोकन
32,913 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2.5 3.7 7.0 22.2% 1 12.50s 7,888 61,297 0
Ling 3.0 Tiny 4.2 10.0 0.0% 0 1.19s 8,307 798 0

त्वरित तुलना

तुलना जोड़ी बदलें