नेविगेशन
Advertise here

Ling 3.0 Tiny (default) vs gpt-oss-120b

gpt-oss-120b average score में आगे है: 4.2 vs 3.8. Ling 3.0 Tiny (default) की benchmark लागत कम है: $0.000 vs $0.016. Ling 3.0 Tiny (default) तेज है: 13.39s vs 28.63s, pass rates 8.7% vs 34.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#370
कुल आउटपुट टोकन
110,071
प्रतिक्रिया समय (औसत)
13.39s
कुल लागत
$0.000
रैंक
#361
कुल आउटपुट टोकन
62,213
प्रतिक्रिया समय (औसत)
28.63s
कुल लागत
$0.016
अनुशंसित मॉडल gpt-oss-120b

इस तुलना में इसका स्कोर सबसे अधिक है (4.2) और 2 मॉडलों में लागत और प्रतिक्रिया समय का समग्र संतुलन सबसे अच्छा है।

विस्तृत तुलना

मेट्रिक Ling 3.0 Tiny Ling 3.0 Tiny default रिलीज़: 2026-08-07 gpt-oss-120b gpt-oss-120b none रिलीज़: 2025-08-05
स्कोर 3.8 4.2
रैंक #370 #361
विश्वसनीयता 9.8 10.0
संगति 10.0 7.6
प्रयास 69/69 60/69
सही परीक्षण
प्रति प्रयास पास दर 8.7% 34.8%
अस्थिर टेस्ट 0 3
कुल रन 69 60
प्रति परिणाम लागत 0.000 0.274
कुल लागत $0.000 $0.016
इनपुट कीमत $0.000 / 1M $0.037 / 1M
आउटपुट कीमत $0.000 / 1M $0.170 / 1M
कैश पढ़ने की कीमत लागू नहीं लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 184,579 131,652
आउटपुट टोकन 110,071 16,869
रीजनिंग टोकन 0 53,081
प्रतिक्रिया समय (औसत) 13.39s 28.63s
प्रतिक्रिया समय (अधिकतम) 240.61s 140.90s
प्रतिक्रिया समय (कुल) 294.48s 486.69s
पैरामीटर 7.9B कुल (1.3B सक्रिय) 117B कुल (5.1B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#370 Ling 3.0 Tiny

default
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
334.1s
टोकन
32,913 tok

#361 gpt-oss-120b

none
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling 3.0 Tiny 4.2 10.0 0.0% 0 1.19s 8,307 798 0
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028

तुलना जोड़ी बदलें

Ling 3.0 TinydefaultvsNemotron 3.5 Lightningnoneनिःशुल्क उपलब्धgpt-oss-120bnonevsGLM 4.7 FlashmediumMiniMax M2.5mediumvsgpt-oss-120bnonegpt-oss-120bnonevsQwen3.5-9BmediumCobuddymediumनिःशुल्क उपलब्धvsgpt-oss-120bnoneLing 3.0 TinydefaultvsQwen3.5-9BmediumTrinity Large Previewdefaultनिःशुल्क उपलब्धvsgpt-oss-120bnoneKAT Coder AIR V2.5defaultvsgpt-oss-120bnoneMercury 2.5nonevsLing 3.0 TinydefaultRing 2.6 1tdefaultvsgpt-oss-120bnoneGranite 4.1 8bdefaultvsgpt-oss-120bnoneLing 2.6 Flashdefaultvsgpt-oss-120bnone