नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ling 3.0 Tiny (high) vs Decider V1.1 27B (default)

Ling 3.0 Tiny (high) average score में आगे है: 3.7 vs 2.6. Ling 3.0 Tiny (high) की benchmark लागत कम है: $0.000 vs $0.002. Decider V1.1 27B (default) तेज है: 320ms vs 72.24s, pass rates 23.2% vs 17.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#373
कुल आउटपुट टोकन
939,018
प्रतिक्रिया समय (औसत)
72.24s
कुल लागत
$0.000
रैंक
#395
कुल आउटपुट टोकन
69
प्रतिक्रिया समय (औसत)
320ms
कुल लागत
$0.002
अनुशंसित मॉडल Ling 3.0 Tiny (high)

इस तुलना में इसका स्कोर सबसे अधिक है (3.7) और 2 मॉडलों में लागत और प्रतिक्रिया समय का समग्र संतुलन सबसे अच्छा है।

विस्तृत तुलना

मेट्रिक Ling 3.0 Tiny Ling 3.0 Tiny high रिलीज़: 2026-08-07 Decider V1.1 27B Decider V1.1 27B default रिलीज़: 2026-10-07
स्कोर 3.7 2.6
रैंक #373 #395
विश्वसनीयता 10.0 10.0
संगति 8.9 5.2
प्रयास 69/69 36/69
सही परीक्षण
प्रति प्रयास पास दर 23.2% 17.4%
अस्थिर टेस्ट 3 0
कुल रन 69 36
प्रति परिणाम लागत 0.000 0.037
कुल लागत $0.000 $0.002
इनपुट कीमत $0.000 / 1M $0.020 / 1M
आउटपुट कीमत $0.000 / 1M $0.000 / 1M
कैश पढ़ने की कीमत लागू नहीं लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 115,314 73,557
आउटपुट टोकन 133,965 69
रीजनिंग टोकन 816,718 0
प्रतिक्रिया समय (औसत) 72.24s 320ms
प्रतिक्रिया समय (अधिकतम) 345.15s 491ms
प्रतिक्रिया समय (कुल) 1589.23s 3.84s
पैरामीटर 7.9B कुल (1.3B सक्रिय) 27B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#373 Ling 3.0 Tiny

high
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
169.5s
टोकन
5,252 tok

#395 Decider V1.1 27B

default
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

तुलना जोड़ी बदलें

Ling 3.0 TinyhighvsNemotron 3.5 Lightningnoneनिःशुल्क उपलब्धGranite 4.1 8bdefaultvsLing 3.0 TinyhighLing 3.0 TinyhighvsGrok 4.20noneCommand A+mediumvsLing 3.0 TinyhighLing 3.0 TinyhighvsQwen3.5-9BmediumCommand A+lowvsDecider V1.1 27BdefaultMercury 2.5nonevsLing 3.0 TinyhighCommand A+nonevsDecider V1.1 27BdefaultLing 3.0 Tinyhighvsgpt-oss-120bnoneLing 3.0 TinyhighvsGLM 4.7 FlashmediumLing 3.0 TinyhighvsMiniMax M2.5mediumCommand A+highvsDecider V1.1 27Bdefault