नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed 2.1 Turbo (medium) vs Qwen3.8 27B (high)

average score लगभग बराबर है: 8.4 vs 8.4. Qwen3.8 27B (high) की benchmark लागत कम है: ~$0.287 vs $1.951. Qwen3.8 27B (high) तेज है: 167.89s vs 193.59s, pass rates 78.8% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#67
कुल आउटपुट टोकन
759,191
प्रतिक्रिया समय (औसत)
193.59s
कुल लागत
$1.951
रैंक
#65
कुल आउटपुट टोकन
656,635
प्रतिक्रिया समय (औसत)
167.89s
कुल लागत
~$0.287
अनुशंसित मॉडल Qwen3.8 27B (high)

It has the best score here (8.4), while costing about 6.8x less than Seed 2.1 Turbo (medium).

विस्तृत तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo medium रिलीज़: 2026-08-12 Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14
स्कोर 8.4 8.4
रैंक #67 #65
विश्वसनीयता 10.0 9.6
संगति 8.2 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 77.3%
अस्थिर टेस्ट 5 2
कुल रन 66 66
प्रति परिणाम लागत 13.002 ~1.792
कुल लागत $1.951 ~$0.287
इनपुट कीमत $0.500 / 1M लागू नहीं
आउटपुट कीमत $2.500 / 1M लागू नहीं
कुल इनपुट टोकन 104,433 100,179
आउटपुट टोकन 6,511 904
रीजनिंग टोकन 752,680 655,731
प्रतिक्रिया समय (औसत) 193.59s 167.89s
प्रतिक्रिया समय (अधिकतम) 885.33s 640.85s
प्रतिक्रिया समय (कुल) 4258.98s 3693.54s
पैरामीटर ~200B कुल (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Seed 2.1 Turbo

medium
लागत
$0.099
समय
583.9s
टोकन
39,514 tok

#65 Qwen3.8 27B

high
लागत
~$0.008
समय
270.1s
टोकन
18,963 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed 2.1 Turbo 8.2 7.2 88.9% 1 354.87s 8,220 384 205,892
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2mediumvsQwen3.8 27BhighQwen3.8 27BhighvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsGPT-6 SollowSeed 2.1 TurbomediumvsInkling SmallhighQwen3.8 27BhighvsGrok 4.5lowGPT-6 SollowvsQwen3.8 27BhighSeed 2.1 TurbomediumvsGrok 4.5lowSeed 2.1 TurbomediumvsGLM 5.3 FlashXmaxQwen3.8 27BhighvsGLM 5.3 FlashXmaxQwen3.8 27BhighvsGrok 4.6mediumSeed 2.1 TurbomediumvsDeepSeek V4.1 FlashmaxDeepSeek V4.1 FlashmaxvsQwen3.8 27Bhigh