नेव्हिगेशन
Advertise here

Seed-2.0-Lite (medium) vs Qwen3.8 27B (low)

Qwen3.8 27B (low) average score मध्ये पुढे आहे: 7.9 vs 7.8. Qwen3.8 27B (low) चा benchmark खर्च कमी आहे: ~$0.071 vs $0.236. Qwen3.8 27B (low) वेगवान आहे: 39.11s vs 47.94s, pass rates 69.7% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-28

तुलना केलेली मॉडेल्स

क्रमांक
#102
एकूण आउटपुट टोकन्स
101,296
प्रतिसाद वेळ (सरासरी)
47.94s
एकूण खर्च
$0.236
क्रमांक
#93
एकूण आउटपुट टोकन्स
169,329
प्रतिसाद वेळ (सरासरी)
39.11s
एकूण खर्च
~$0.071
शिफारस केलेले मॉडेल Qwen3.8 27B (low)

It has the best score here (7.9), while costing about 3.3x less than Seed-2.0-Lite (medium).

तपशीलवार तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium प्रकाशन: 2026-02-14 Qwen3.8 27B Qwen3.8 27B low प्रकाशन: 2026-08-14
स्कोअर 7.8 7.9
क्रमांक #102 #93
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 68.2%
अस्थिर चाचण्या 4 0
एकूण रन 66 66
प्रति निकाल खर्च 1.809 ~0.473
एकूण खर्च $0.236 ~$0.071
इनपुट किंमत $0.250 / 1M लागू नाही
आउटपुट किंमत $2.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 129,906 99,705
आउटपुट टोकन्स 12,530 1,545
रिझनिंग टोकन्स 88,766 167,784
प्रतिसाद वेळ (सरासरी) 47.94s 39.11s
प्रतिसाद वेळ (कमाल) 254.92s 376.04s
प्रतिसाद वेळ (एकूण) 1054.57s 860.51s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 Seed-2.0-Lite

medium
खर्च
$0.005
वेळ
86.7s
टोकन्स
2,354 tok

#93 Qwen3.8 27B

low
खर्च
~$0.003
वेळ
92.8s
टोकन्स
6,902 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

झटपट तुलना

तुलना जोडी बदला

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowGPT-6 LunamediumvsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27Blow