नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Lite vs Qwen3.5-35B-A3B (medium)

average score लगभग बराबर है: 6.2 vs 6.2. Seed-2.0-Lite की benchmark लागत कम है: $0.066 vs $0.837. Seed-2.0-Lite तेज है: 4.40s vs 112.47s, pass rates 43.9% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#130
कुल आउटपुट टोकन
14,746
प्रतिक्रिया समय (औसत)
4.40s
कुल लागत
$0.066
रैंक
#133
कुल आउटपुट टोकन
826,670
प्रतिक्रिया समय (औसत)
112.47s
कुल लागत
$0.837
अनुशंसित मॉडल Seed-2.0-Lite

It has the best score here (6.2), while costing about 12.9x less than Qwen3.5-35B-A3B (medium).

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite none रिलीज़: 2026-02-14 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium रिलीज़: 2026-02-24
स्कोर 6.2 6.2
रैंक #130 #133
विश्वसनीयता 10.0 10.0
संगति 8.5 7.6
सही परीक्षण
प्रति प्रयास पास दर 43.9% 66.7%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 0.814 9.130
कुल लागत $0.066 $0.837
इनपुट कीमत $0.250 / 1M $0.140 / 1M
आउटपुट कीमत $2.000 / 1M $1.000 / 1M
कुल इनपुट टोकन 142,197 130,388
आउटपुट टोकन 14,746 40,630
रीजनिंग टोकन 0 786,040
प्रतिक्रिया समय (औसत) 4.40s 112.47s
प्रतिक्रिया समय (अधिकतम) 44.58s 950.25s
प्रतिक्रिया समय (कुल) 96.84s 2474.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#130 Seed-2.0-Lite

none
लागत
$0.005
समय
83.8s
टोकन
2,311 tok

#133 Qwen3.5-35B-A3B

medium
लागत
$0.009
समय
71.4s
टोकन
8,631 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 5.6 10.0 33.3% 0 2.83s 8,215 410 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

त्वरित तुलना

तुलना जोड़ी बदलें