नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed-2.0-Lite (medium) vs Qwen3.8 27B (medium)

average score जवळपास समान आहे: 7.8 vs 7.8. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. Qwen3.8 27B (medium) वेगवान आहे: 33.05s vs 47.94s, pass rates 69.7% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#69
एकूण आउटपुट टोकन्स
101,296
प्रतिसाद वेळ (सरासरी)
47.94s
एकूण खर्च
$0.236
क्रमांक
#68
एकूण आउटपुट टोकन्स
136,162
प्रतिसाद वेळ (सरासरी)
33.05s
एकूण खर्च
लागू नाही
शिफारस केलेले मॉडेल Seed-2.0-Lite (medium)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium प्रकाशन: 2026-02-14 Qwen3.8 27B Qwen3.8 27B medium प्रकाशन: 2026-08-14
स्कोअर 7.8 7.8
क्रमांक #69 #68
विश्वसनीयता 10.0 9.6
सुसंगतता 8.6 9.7
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 66.7%
अस्थिर चाचण्या 4 1
एकूण रन 66 66
प्रति निकाल खर्च 1.809 लागू नाही
एकूण खर्च $0.236 लागू नाही
इनपुट किंमत $0.250 / 1M लागू नाही
आउटपुट किंमत $2.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 129,906 98,266
आउटपुट टोकन्स 12,530 1,861
रिझनिंग टोकन्स 88,766 134,301
प्रतिसाद वेळ (सरासरी) 47.94s 33.05s
प्रतिसाद वेळ (कमाल) 254.92s 214.63s
प्रतिसाद वेळ (एकूण) 1054.57s 694.04s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
खर्च
$0.005
वेळ
86.7s
टोकन्स
2,354 tok

#68 Qwen3.8 27B

medium
खर्च
लागू नाही
वेळ
43.4s
टोकन्स
2,956 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

झटपट तुलना

तुलना जोडी बदला

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 ProhighDeepSeek V4 ProhighvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423highGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumSeed-2.0-LitemediumvsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BmediumSeed-2.0-LitemediumvsGPT-5.2 Chatnone