नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4.1 Flash (max) vs Qwen3.8 27B (high)

Qwen3.8 27B (high) average score में आगे है: 8.4 vs 8.3. Qwen3.8 27B (high) की benchmark लागत कम है: ~$0.287 vs $0.537. DeepSeek V4.1 Flash (max) तेज है: 61.35s vs 167.89s, pass rates 68.2% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#62
कुल आउटपुट टोकन
871,126
प्रतिक्रिया समय (औसत)
61.35s
कुल लागत
$0.537
रैंक
#59
कुल आउटपुट टोकन
656,635
प्रतिक्रिया समय (औसत)
167.89s
कुल लागत
~$0.287
अनुशंसित मॉडल Qwen3.8 27B (high)

It has the best score here (8.4), while costing about 1.9x less than DeepSeek V4.1 Flash (max).

विस्तृत तुलना

मेट्रिक DeepSeek V4.1 Flash DeepSeek V4.1 Flash max रिलीज़: 2026-09-10 Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14
स्कोर 8.3 8.4
रैंक #62 #59
विश्वसनीयता 9.1 9.6
संगति 9.2 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 77.3%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 3.829 ~1.792
कुल लागत $0.537 ~$0.287
इनपुट कीमत $0.150 / 1M लागू नहीं
आउटपुट कीमत $0.600 / 1M लागू नहीं
कुल इनपुट टोकन 89,024 100,179
आउटपुट टोकन 5,558 904
रीजनिंग टोकन 865,568 655,731
प्रतिक्रिया समय (औसत) 61.35s 167.89s
प्रतिक्रिया समय (अधिकतम) 335.08s 640.85s
प्रतिक्रिया समय (कुल) 1349.61s 3693.54s
पैरामीटर 748B कुल (16B सक्रिय) 27.3B
उपलब्धता मुक्त स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 DeepSeek V4.1 Flash

max
लागत
$0.066
समय
211.0s
टोकन
54,712 tok

#59 Qwen3.8 27B

high
लागत
~$0.008
समय
270.1s
टोकन
18,963 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 62.50s 7,509 373 132,357
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowDeepSeek V4.1 FlashmaxvsMuse Spark 1.1lowDeepSeek V4.1 FlashmaxvsInkling SmallhighQwen3.8 27BhighvsGrok 4.6mediumSeed 2.1 TurbomediumvsDeepSeek V4.1 FlashmaxDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsQwen3.8 27BhighClaude Fable 5.1mediumvsDeepSeek V4.1 FlashmaxDeepSeek V4.1 FlashmaxvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.5medium