नेव्हिगेशन
AI BENCHY
Advertise here

Seed 2.1 Turbo (medium) vs Qwen3.8 27B (high)

average score जवळपास समान आहे: 8.4 vs 8.4. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. Qwen3.8 27B (high) वेगवान आहे: 167.89s vs 193.59s, pass rates 78.8% vs 77.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#43
एकूण आउटपुट टोकन्स
759,191
प्रतिसाद वेळ (सरासरी)
193.59s
एकूण खर्च
$1.951
क्रमांक
#42
एकूण आउटपुट टोकन्स
656,635
प्रतिसाद वेळ (सरासरी)
167.89s
एकूण खर्च
लागू नाही
शिफारस केलेले मॉडेल Seed 2.1 Turbo (medium)

It has the strongest score in this comparison (8.4) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo medium प्रकाशन: 2026-08-12 Qwen3.8 27B Qwen3.8 27B high प्रकाशन: 2026-08-14
स्कोअर 8.4 8.4
क्रमांक #43 #42
विश्वसनीयता 10.0 9.6
सुसंगतता 8.2 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 78.8% 77.3%
अस्थिर चाचण्या 5 2
एकूण रन 66 66
प्रति निकाल खर्च 13.002 लागू नाही
एकूण खर्च $1.951 लागू नाही
इनपुट किंमत $0.500 / 1M लागू नाही
आउटपुट किंमत $2.500 / 1M लागू नाही
एकूण इनपुट टोकन्स 104,433 100,179
आउटपुट टोकन्स 6,511 904
रिझनिंग टोकन्स 752,680 655,731
प्रतिसाद वेळ (सरासरी) 193.59s 167.89s
प्रतिसाद वेळ (कमाल) 885.33s 640.85s
प्रतिसाद वेळ (एकूण) 4258.98s 3693.54s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#43 Seed 2.1 Turbo

medium
खर्च
$0.099
वेळ
583.9s
टोकन्स
39,514 tok

#42 Qwen3.8 27B

high
खर्च
लागू नाही
वेळ
270.1s
टोकन्स
18,963 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed 2.1 Turbo 8.2 7.2 88.9% 1 354.87s 8,220 384 205,892
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

झटपट तुलना

तुलना जोडी बदला

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsInkling SmallhighQwen3.8 27BhighvsGrok 4.5lowSeed 2.1 TurbomediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.6mediumMuse Spark 1.2lowvsQwen3.8 27BhighSeed 2.1 TurbomediumvsMuse Spark 1.2lowQwen3.8 27BhighvsGrok 4.5mediumSeed 2.1 TurbomediumvsMuse Spark 1.1lowMuse Spark 1.1lowvsQwen3.8 27BhighGPT-5.4mediumvsQwen3.8 27BhighGemini 2.5 FlashmediumvsQwen3.8 27Bhigh