नेविगेशन
Advertise here

Ling 3.0 Tiny (high) vs GPT-6 Luna Decisions (default)

Ling 3.0 Tiny (high) average score में आगे है: 3.7 vs 2.4. Ling 3.0 Tiny (high) की benchmark लागत कम है: $0.000 vs $0.005. GPT-6 Luna Decisions (default) तेज है: 495ms vs 72.24s, pass rates 23.2% vs 13.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#368
कुल आउटपुट टोकन
939,018
प्रतिक्रिया समय (औसत)
72.24s
कुल लागत
$0.000
रैंक
#390
कुल आउटपुट टोकन
0
प्रतिक्रिया समय (औसत)
495ms
कुल लागत
$0.005
अनुशंसित मॉडल Ling 3.0 Tiny (high)

It has the strongest score in this comparison (3.7) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Ling 3.0 Tiny Ling 3.0 Tiny high रिलीज़: 2026-08-07 GPT-6 Luna Decisions GPT-6 Luna Decisions default रिलीज़: 2026-10-07
स्कोर 3.7 2.4
रैंक #368 #390
विश्वसनीयता 10.0 10.0
संगति 8.9 5.2
प्रयास 69/69 36/69
सही परीक्षण
प्रति प्रयास पास दर 23.2% 13.0%
अस्थिर टेस्ट 3 0
कुल रन 69 36
प्रति परिणाम लागत 0.000 0.159
कुल लागत $0.000 $0.005
इनपुट कीमत $0.000 / 1M $0.100 / 1M
आउटपुट कीमत $0.000 / 1M $0.000 / 1M
कैश पढ़ने की कीमत लागू नहीं $0.000 / 1M
कैश लिखने की कीमत लागू नहीं $0.000 / 1M
कुल इनपुट टोकन 115,314 47,583
आउटपुट टोकन 133,965 0
रीजनिंग टोकन 816,718 0
प्रतिक्रिया समय (औसत) 72.24s 495ms
प्रतिक्रिया समय (अधिकतम) 345.15s 842ms
प्रतिक्रिया समय (कुल) 1589.23s 5.94s
पैरामीटर 7.9B कुल (1.3B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#368 Ling 3.0 Tiny

high
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
169.5s
टोकन
5,252 tok

#390 GPT-6 Luna Decisions

default
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

त्वरित तुलना

तुलना जोड़ी बदलें

Ling 3.0 TinyhighvsNemotron 3.5 Lightningnoneनिःशुल्क उपलब्धGranite 4.1 8bdefaultvsLing 3.0 TinyhighLing 3.0 TinyhighvsGrok 4.20noneCommand A+mediumvsLing 3.0 TinyhighLing 3.0 TinyhighvsQwen3.5-9BmediumMercury 2.5nonevsLing 3.0 TinyhighLing 3.0 Tinyhighvsgpt-oss-120bnoneLing 3.0 TinyhighvsGLM 4.7 FlashmediumCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultLing 3.0 TinyhighvsMiniMax M2.5mediumGemini 3 Flash PreviewhighvsGPT-6 Luna Decisionsdefault