नेव्हिगेशन
AI BENCHY
Advertise here

Seed-2.0-Lite (medium) vs Qwen3.8 27B (low)

Qwen3.8 27B (low) average score मध्ये पुढे आहे: 7.9 vs 7.8. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. Qwen3.8 27B (low) वेगवान आहे: 39.11s vs 47.94s, pass rates 69.7% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#69
एकूण आउटपुट टोकन्स
101,296
प्रतिसाद वेळ (सरासरी)
47.94s
एकूण खर्च
$0.236
क्रमांक
#61
एकूण आउटपुट टोकन्स
169,329
प्रतिसाद वेळ (सरासरी)
39.11s
एकूण खर्च
लागू नाही
शिफारस केलेले मॉडेल Seed-2.0-Lite (medium)

It has the best overall balance of score, reliability, cost, and response time in this comparison.

तपशीलवार तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium प्रकाशन: 2026-02-14 Qwen3.8 27B Qwen3.8 27B low प्रकाशन: 2026-08-14
स्कोअर 7.8 7.9
क्रमांक #69 #61
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 68.2%
अस्थिर चाचण्या 4 0
एकूण रन 66 66
प्रति निकाल खर्च 1.809 लागू नाही
एकूण खर्च $0.236 लागू नाही
इनपुट किंमत $0.250 / 1M लागू नाही
आउटपुट किंमत $2.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 129,906 99,705
आउटपुट टोकन्स 12,530 1,545
रिझनिंग टोकन्स 88,766 167,784
प्रतिसाद वेळ (सरासरी) 47.94s 39.11s
प्रतिसाद वेळ (कमाल) 254.92s 376.04s
प्रतिसाद वेळ (एकूण) 1054.57s 860.51s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
खर्च
$0.005
वेळ
86.7s
टोकन्स
2,354 tok

#61 Qwen3.8 27B

low
खर्च
लागू नाही
वेळ
92.8s
टोकन्स
6,902 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

झटपट तुलना

तुलना जोडी बदला

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2high