नेविगेशन
Advertise here

Ling-3.0-flash (high) vs LongCat 2.0

average score लगभग बराबर है: 6.4 vs 6.4. Ling-3.0-flash (high) की benchmark लागत कम है: $0.021 vs $0.044. LongCat 2.0 तेज है: 5.17s vs 13.70s, pass rates 63.6% vs 40.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#184
कुल आउटपुट टोकन
299,456
प्रतिक्रिया समय (औसत)
13.70s
कुल लागत
$0.021
रैंक
#182
कुल आउटपुट टोकन
9,375
प्रतिक्रिया समय (औसत)
5.17s
कुल लागत
$0.044
अनुशंसित मॉडल LongCat 2.0

It has the best score here (6.4), while responding about 2.6x faster than Ling-3.0-flash (high).

विस्तृत तुलना

मेट्रिक Ling-3.0-flash Ling-3.0-flash high रिलीज़: 2026-07-24 LongCat 2.0 LongCat 2.0 none रिलीज़: 2026-07-20
स्कोर 6.4 6.4
रैंक #184 #182
विश्वसनीयता 9.8 10.0
संगति 8.6 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 40.9%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 0.000 0.549
कुल लागत $0.021 $0.044
इनपुट कीमत $0.021 / 1M $0.300 / 1M
आउटपुट कीमत $0.063 / 1M $1.200 / 1M
कुल इनपुट टोकन 132,044 108,752
आउटपुट टोकन 92,135 9,375
रीजनिंग टोकन 207,321 0
प्रतिक्रिया समय (औसत) 13.70s 5.17s
प्रतिक्रिया समय (अधिकतम) 75.27s 48.38s
प्रतिक्रिया समय (कुल) 287.75s 113.83s
पैरामीटर 124B कुल (5.1B सक्रिय) 1.6T कुल (48B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#184 Ling-3.0-flash

high
लागत
$0.000
समय
30.7s
टोकन
10,576 tok

#182 LongCat 2.0

none
लागत
$0.027
समय
411.7s
टोकन
22,283 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling-3.0-flash 6.7 5.0 66.7% 2 14.85s 8,298 15,602 32,152
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

त्वरित तुलना

तुलना जोड़ी बदलें