नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Lite (medium) vs Qwen3.8 27B (medium)

average score लगभग बराबर है: 7.8 vs 7.8. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। Qwen3.8 27B (medium) तेज है: 33.05s vs 47.94s, pass rates 69.7% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#69
कुल आउटपुट टोकन
101,296
प्रतिक्रिया समय (औसत)
47.94s
कुल लागत
$0.236
रैंक
#68
कुल आउटपुट टोकन
136,162
प्रतिक्रिया समय (औसत)
33.05s
कुल लागत
लागू नहीं
अनुशंसित मॉडल Seed-2.0-Lite (medium)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium रिलीज़: 2026-02-14 Qwen3.8 27B Qwen3.8 27B medium रिलीज़: 2026-08-14
स्कोर 7.8 7.8
रैंक #69 #68
विश्वसनीयता 10.0 9.6
संगति 8.6 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 66.7%
अस्थिर टेस्ट 4 1
कुल रन 66 66
प्रति परिणाम लागत 1.809 लागू नहीं
कुल लागत $0.236 लागू नहीं
इनपुट कीमत $0.250 / 1M लागू नहीं
आउटपुट कीमत $2.000 / 1M लागू नहीं
कुल इनपुट टोकन 129,906 98,266
आउटपुट टोकन 12,530 1,861
रीजनिंग टोकन 88,766 134,301
प्रतिक्रिया समय (औसत) 47.94s 33.05s
प्रतिक्रिया समय (अधिकतम) 254.92s 214.63s
प्रतिक्रिया समय (कुल) 1054.57s 694.04s
पैरामीटर ~200B कुल (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
लागत
$0.005
समय
86.7s
टोकन
2,354 tok

#68 Qwen3.8 27B

medium
लागत
लागू नहीं
समय
43.4s
टोकन
2,956 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 ProhighDeepSeek V4 ProhighvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423highGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumSeed-2.0-LitemediumvsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BmediumSeed-2.0-LitemediumvsGPT-5.2 Chatnone