नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4.1 Flash (low) vs Qwen3.8 27B (high)

DeepSeek V4.1 Flash (low) average score में आगे है: 8.5 vs 8.4. DeepSeek V4.1 Flash (low) की benchmark लागत कम है: $0.224 vs ~$0.287. DeepSeek V4.1 Flash (low) तेज है: 26.77s vs 167.89s, pass rates 74.2% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#51
कुल आउटपुट टोकन
347,963
प्रतिक्रिया समय (औसत)
26.77s
कुल लागत
$0.224
रैंक
#59
कुल आउटपुट टोकन
656,635
प्रतिक्रिया समय (औसत)
167.89s
कुल लागत
~$0.287
अनुशंसित मॉडल DeepSeek V4.1 Flash (low)

It has the best score here (8.5), while responding about 6.3x faster than Qwen3.8 27B (high).

विस्तृत तुलना

मेट्रिक DeepSeek V4.1 Flash DeepSeek V4.1 Flash low रिलीज़: 2026-09-10 Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14
स्कोर 8.5 8.4
रैंक #51 #59
विश्वसनीयता 9.5 9.6
संगति 8.9 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 74.2% 77.3%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 1.492 ~1.792
कुल लागत $0.224 ~$0.287
इनपुट कीमत $0.150 / 1M लागू नहीं
आउटपुट कीमत $0.600 / 1M लागू नहीं
कुल इनपुट टोकन 99,715 100,179
आउटपुट टोकन 6,381 904
रीजनिंग टोकन 341,582 655,731
प्रतिक्रिया समय (औसत) 26.77s 167.89s
प्रतिक्रिया समय (अधिकतम) 149.84s 640.85s
प्रतिक्रिया समय (कुल) 589.01s 3693.54s
पैरामीटर 748B कुल (16B सक्रिय) 27.3B
उपलब्धता मुक्त स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#51 DeepSeek V4.1 Flash

low
लागत
$0.017
समय
43.6s
टोकन
14,069 tok

#59 Qwen3.8 27B

high
लागत
~$0.008
समय
270.1s
टोकन
18,963 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 40.66s 7,509 378 81,978
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighDeepSeek V4.1 FlashlowvsGrok 4.5mediumQwen3.8 27BhighvsGrok 4.5lowDeepSeek V4.1 FlashlowvsGrok 4.6mediumQwen3.8 27BhighvsGrok 4.6mediumDeepSeek V4.1 FlashlowvsGPT-5.4mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighMuse Spark 1.2lowvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGPT-5.2mediumDeepSeek V4.1 FlashmediumvsQwen3.8 27Bhigh