नेविगेशन
Advertise here

Seed-2.0-Lite vs LongCat 2.0

LongCat 2.0 average score में आगे है: 6.4 vs 6.2. LongCat 2.0 की benchmark लागत कम है: $0.044 vs $0.066. Seed-2.0-Lite तेज है: 4.37s vs 5.17s, pass rates 40.9% vs 40.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#188
कुल आउटपुट टोकन
14,744
प्रतिक्रिया समय (औसत)
4.37s
कुल लागत
$0.066
रैंक
#182
कुल आउटपुट टोकन
9,375
प्रतिक्रिया समय (औसत)
5.17s
कुल लागत
$0.044
अनुशंसित मॉडल LongCat 2.0

It has the strongest score in this comparison (6.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite none रिलीज़: 2026-02-14 LongCat 2.0 LongCat 2.0 none रिलीज़: 2026-07-20
स्कोर 6.2 6.4
रैंक #188 #182
विश्वसनीयता 10.0 10.0
संगति 8.9 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 40.9% 40.9%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 0.813 0.549
कुल लागत $0.066 $0.044
इनपुट कीमत $0.250 / 1M $0.300 / 1M
आउटपुट कीमत $2.000 / 1M $1.200 / 1M
कुल इनपुट टोकन 142,206 108,752
आउटपुट टोकन 14,744 9,375
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 4.37s 5.17s
प्रतिक्रिया समय (अधिकतम) 44.58s 48.38s
प्रतिक्रिया समय (कुल) 96.20s 113.83s
पैरामीटर ~200B कुल (~20B सक्रिय) 1.6T कुल (48B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#188 Seed-2.0-Lite

none
लागत
$0.005
समय
83.8s
टोकन
2,311 tok

#182 LongCat 2.0

none
लागत
$0.027
समय
411.7s
टोकन
22,283 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 5.6 10.0 33.3% 0 2.83s 8,215 410 0
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

त्वरित तुलना

तुलना जोड़ी बदलें