नेविगेशन
AI BENCHY
Advertise here

Seed 2.1 Turbo (medium) vs Qwen3.8 27B (high)

average score लगभग बराबर है: 8.4 vs 8.4. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। Qwen3.8 27B (high) तेज है: 167.89s vs 193.59s, pass rates 78.8% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#43
कुल आउटपुट टोकन
759,191
प्रतिक्रिया समय (औसत)
193.59s
कुल लागत
$1.951
रैंक
#42
कुल आउटपुट टोकन
656,635
प्रतिक्रिया समय (औसत)
167.89s
कुल लागत
लागू नहीं
अनुशंसित मॉडल Seed 2.1 Turbo (medium)

It has the strongest score in this comparison (8.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo medium रिलीज़: 2026-08-12 Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14
स्कोर 8.4 8.4
रैंक #43 #42
विश्वसनीयता 10.0 9.6
संगति 8.2 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 77.3%
अस्थिर टेस्ट 5 2
कुल रन 66 66
प्रति परिणाम लागत 13.002 लागू नहीं
कुल लागत $1.951 लागू नहीं
इनपुट कीमत $0.500 / 1M लागू नहीं
आउटपुट कीमत $2.500 / 1M लागू नहीं
कुल इनपुट टोकन 104,433 100,179
आउटपुट टोकन 6,511 904
रीजनिंग टोकन 752,680 655,731
प्रतिक्रिया समय (औसत) 193.59s 167.89s
प्रतिक्रिया समय (अधिकतम) 885.33s 640.85s
प्रतिक्रिया समय (कुल) 4258.98s 3693.54s
पैरामीटर ~200B कुल (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#43 Seed 2.1 Turbo

medium
लागत
$0.099
समय
583.9s
टोकन
39,514 tok

#42 Qwen3.8 27B

high
लागत
लागू नहीं
समय
270.1s
टोकन
18,963 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed 2.1 Turbo 8.2 7.2 88.9% 1 354.87s 8,220 384 205,892
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsInkling SmallhighQwen3.8 27BhighvsGrok 4.5lowSeed 2.1 TurbomediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.6mediumMuse Spark 1.2lowvsQwen3.8 27BhighSeed 2.1 TurbomediumvsMuse Spark 1.2lowQwen3.8 27BhighvsGrok 4.5mediumSeed 2.1 TurbomediumvsMuse Spark 1.1lowMuse Spark 1.1lowvsQwen3.8 27BhighGPT-5.4mediumvsQwen3.8 27BhighGemini 2.5 FlashmediumvsQwen3.8 27Bhigh