नेविगेशन
Advertise here

Command A+ (medium) vs Ling 3.0 Tiny

Ling 3.0 Tiny average score में आगे है: 4.0 vs 3.0. benchmark लागत लगभग बराबर है: $0.000 vs $0.000. Ling 3.0 Tiny तेज है: 14.02s vs 90.76s, pass rates 0.0% vs 9.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#355
कुल आउटपुट टोकन
0
प्रतिक्रिया समय (औसत)
90.76s
कुल लागत
$0.000
रैंक
#338
कुल आउटपुट टोकन
110,071
प्रतिक्रिया समय (औसत)
14.02s
कुल लागत
$0.000
अनुशंसित मॉडल Ling 3.0 Tiny

It has the best score here (4.0), while responding about 6.5x faster than Command A+ (medium).

विस्तृत तुलना

मेट्रिक Command A+ Command A+ medium रिलीज़: 2026-09-23 Ling 3.0 Tiny Ling 3.0 Tiny none रिलीज़: 2026-08-07
स्कोर 3.0 4.0
रैंक #355 #338
विश्वसनीयता 0.0 9.8
संगति 10.0 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 0.0% 9.1%
अस्थिर टेस्ट 0 0
कुल रन 66 66
प्रति परिणाम लागत 0.000 0.000
कुल लागत $0.000 $0.000
इनपुट कीमत $0.300 / 1M $0.000 / 1M
आउटपुट कीमत $1.500 / 1M $0.000 / 1M
कुल इनपुट टोकन 0 184,579
आउटपुट टोकन 0 110,071
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 90.76s 14.02s
प्रतिक्रिया समय (अधिकतम) 105.69s 240.61s
प्रतिक्रिया समय (कुल) 1996.78s 294.46s
पैरामीटर 218B कुल (25B सक्रिय) 7.9B कुल (1.3B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#355 Command A+

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#338 Ling 3.0 Tiny

none
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
334.1s
टोकन
32,913 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Command A+ 3.0 10.0 0.0% 0 93.13s 0 0 0
Ling 3.0 Tiny 4.2 10.0 0.0% 0 1.19s 8,307 798 0

त्वरित तुलना

तुलना जोड़ी बदलें