नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Lite (medium) vs DeepSeek V4 Pro (high)

Seed-2.0-Lite (medium) average score में आगे है: 7.8 vs 7.7. Seed-2.0-Lite (medium) की benchmark लागत कम है: $0.236 vs $0.555. Seed-2.0-Lite (medium) तेज है: 47.94s vs 92.50s, pass rates 69.7% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-14

रैंक
#66
कुल आउटपुट टोकन
101,296
प्रतिक्रिया समय (औसत)
47.94s
कुल लागत
$0.236
रैंक
#72
कुल आउटपुट टोकन
209,444
प्रतिक्रिया समय (औसत)
92.50s
कुल लागत
$0.555
अनुशंसित मॉडल Seed-2.0-Lite (medium)

It has the best score here (7.8), while costing about 2.4x less than DeepSeek V4 Pro (high).

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium रिलीज़: 2026-02-14 DeepSeek V4 Pro DeepSeek V4 Pro high रिलीज़: 2026-04-24
स्कोर 7.8 7.7
रैंक #66 #72
विश्वसनीयता 10.0 10.0
संगति 8.6 7.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 63.6%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 1.809 2.251
कुल लागत $0.236 $0.555
इनपुट कीमत $0.250 / 1M $1.169 / 1M
आउटपुट कीमत $2.000 / 1M $2.337 / 1M
कुल इनपुट टोकन 129,906 90,757
आउटपुट टोकन 12,530 22,928
रीजनिंग टोकन 88,766 186,516
प्रतिक्रिया समय (औसत) 47.94s 92.50s
प्रतिक्रिया समय (अधिकतम) 254.92s 416.76s
प्रतिक्रिया समय (कुल) 1054.57s 2035.01s
पैरामीटर ~200B कुल (~20B सक्रिय) 1.6T कुल (49B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Seed-2.0-Lite

medium
लागत
$0.005
समय
86.7s
टोकन
2,354 tok

#72 DeepSeek V4 Pro

high
लागत
$0.023
समय
257.6s
टोकन
14,870 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580

त्वरित तुलना

तुलना जोड़ी बदलें