नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Lite (medium) vs Qwen3.8 27B (low)

Qwen3.8 27B (low) average score में आगे है: 7.9 vs 7.8. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। Qwen3.8 27B (low) तेज है: 39.11s vs 47.94s, pass rates 69.7% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#69
कुल आउटपुट टोकन
101,296
प्रतिक्रिया समय (औसत)
47.94s
कुल लागत
$0.236
रैंक
#61
कुल आउटपुट टोकन
169,329
प्रतिक्रिया समय (औसत)
39.11s
कुल लागत
लागू नहीं
अनुशंसित मॉडल Seed-2.0-Lite (medium)

It has the best overall balance of score, reliability, cost, and response time in this comparison.

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium रिलीज़: 2026-02-14 Qwen3.8 27B Qwen3.8 27B low रिलीज़: 2026-08-14
स्कोर 7.8 7.9
रैंक #69 #61
विश्वसनीयता 10.0 10.0
संगति 8.6 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 68.2%
अस्थिर टेस्ट 4 0
कुल रन 66 66
प्रति परिणाम लागत 1.809 लागू नहीं
कुल लागत $0.236 लागू नहीं
इनपुट कीमत $0.250 / 1M लागू नहीं
आउटपुट कीमत $2.000 / 1M लागू नहीं
कुल इनपुट टोकन 129,906 99,705
आउटपुट टोकन 12,530 1,545
रीजनिंग टोकन 88,766 167,784
प्रतिक्रिया समय (औसत) 47.94s 39.11s
प्रतिक्रिया समय (अधिकतम) 254.92s 376.04s
प्रतिक्रिया समय (कुल) 1054.57s 860.51s
पैरामीटर ~200B कुल (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
लागत
$0.005
समय
86.7s
टोकन
2,354 tok

#61 Qwen3.8 27B

low
लागत
लागू नहीं
समय
92.8s
टोकन
6,902 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2high