नेविगेशन
AI BENCHY
Advertise here

Ling 3.0 Tiny vs gpt-oss-120b

Ling 3.0 Tiny average score में आगे है: 4.0 vs 3.7. Ling 3.0 Tiny की benchmark लागत कम है: $0.000 vs $0.010. Ling 3.0 Tiny तेज है: 14.02s vs 21.61s, pass rates 9.1% vs 33.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#275
कुल आउटपुट टोकन
110,071
प्रतिक्रिया समय (औसत)
14.02s
कुल लागत
$0.000
रैंक
#285
कुल आउटपुट टोकन
51,664
प्रतिक्रिया समय (औसत)
21.61s
कुल लागत
$0.010
अनुशंसित मॉडल Ling 3.0 Tiny

It has the best score here (4.0), while responding about 1.5x faster than gpt-oss-120b.

विस्तृत तुलना

मेट्रिक Ling 3.0 Tiny Ling 3.0 Tiny none रिलीज़: 2026-08-07 gpt-oss-120b gpt-oss-120b none रिलीज़: 2025-08-05 निःशुल्क उपलब्ध
स्कोर 4.0 3.7
रैंक #275 #285
विश्वसनीयता 9.8 10.0
संगति 10.0 7.8
प्रयास 66/66 57/66
सही परीक्षण
प्रति प्रयास पास दर 9.1% 33.3%
अस्थिर टेस्ट 0 2
कुल रन 66 57
प्रति परिणाम लागत 0.000 0.168
कुल लागत $0.000 $0.010
इनपुट कीमत $0.000 / 1M $0.030 / 1M
आउटपुट कीमत $0.000 / 1M $0.170 / 1M
कुल इनपुट टोकन 184,579 9,081
आउटपुट टोकन 110,071 51,664
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 14.02s 21.61s
प्रतिक्रिया समय (अधिकतम) 240.61s 113.71s
प्रतिक्रिया समय (कुल) 294.46s 345.79s
पैरामीटर 7.9B कुल (1.3B सक्रिय) 117B कुल (5.1B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#275 Ling 3.0 Tiny

none
अमान्य SVG
लागत
$0.000
समय
334.1s
टोकन
32,913 tok

#285 gpt-oss-120b

none
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling 3.0 Tiny 4.2 10.0 0.0% 0 1.19s 8,307 798 0
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0

त्वरित तुलना

तुलना जोड़ी बदलें