नेविगेशन
Advertise here

Ling 3.0 Tiny (medium) vs Tev1 4B Experimental

Ling 3.0 Tiny (medium) average score में आगे है: 3.6 vs 1.0. Ling 3.0 Tiny (medium) की benchmark लागत कम है: $0.000 vs $0.002. Tev1 4B Experimental तेज है: 498ms vs 64.99s, pass rates 23.2% vs 13.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#356
कुल आउटपुट टोकन
923,276
प्रतिक्रिया समय (औसत)
64.99s
कुल लागत
$0.000
रैंक
#381
कुल आउटपुट टोकन
96
प्रतिक्रिया समय (औसत)
498ms
कुल लागत
$0.002
अनुशंसित मॉडल Ling 3.0 Tiny (medium)

It has the strongest score in this comparison (3.6) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Ling 3.0 Tiny Ling 3.0 Tiny medium रिलीज़: 2026-08-07 Tev1 4B Experimental Tev1 4B Experimental none रिलीज़: 2026-09-30
स्कोर 3.6 1.0
रैंक #356 #381
विश्वसनीयता 9.6 10.0
संगति 8.9 3.0
प्रयास 69/69 21/69
सही परीक्षण
प्रति प्रयास पास दर 23.2% 13.0%
अस्थिर टेस्ट 3 0
कुल रन 69 21
प्रति परिणाम लागत 0.000 0.048
कुल लागत $0.000 $0.002
इनपुट कीमत $0.000 / 1M $0.042 / 1M
आउटपुट कीमत $0.000 / 1M $0.000 / 1M
कैश पढ़ने की कीमत लागू नहीं लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 103,898 33,864
आउटपुट टोकन 148,304 96
रीजनिंग टोकन 774,972 0
प्रतिक्रिया समय (औसत) 64.99s 498ms
प्रतिक्रिया समय (अधिकतम) 262.20s 602ms
प्रतिक्रिया समय (कुल) 1429.68s 3.49s
पैरामीटर 7.9B कुल (1.3B सक्रिय) 4B
उपलब्धता मुक्त स्रोत वेट उपलब्ध

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#356 Ling 3.0 Tiny

medium
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
177.4s
टोकन
6,873 tok

#381 Together: Tev1 4B Experimental

none
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006
Tev1 4B Experimental 0.0 0.0 0.0% 0 0ms 0 0 0

त्वरित तुलना

तुलना जोड़ी बदलें