नेविगेशन
AI BENCHY
Advertise here

DeepSeek V4 Pro (high) vs Qwen3.8 27B (medium)

Qwen3.8 27B (medium) average score में आगे है: 7.8 vs 7.7. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। Qwen3.8 27B (medium) तेज है: 33.05s vs 92.50s, pass rates 63.6% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#75
कुल आउटपुट टोकन
209,444
प्रतिक्रिया समय (औसत)
92.50s
कुल लागत
$0.555
रैंक
#68
कुल आउटपुट टोकन
136,162
प्रतिक्रिया समय (औसत)
33.05s
कुल लागत
लागू नहीं
अनुशंसित मॉडल DeepSeek V4 Pro (high)

It has the best overall balance of score, reliability, cost, and response time in this comparison.

विस्तृत तुलना

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro high रिलीज़: 2026-04-24 Qwen3.8 27B Qwen3.8 27B medium रिलीज़: 2026-08-14
स्कोर 7.7 7.8
रैंक #75 #68
विश्वसनीयता 10.0 9.6
संगति 7.7 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 66.7%
अस्थिर टेस्ट 6 1
कुल रन 66 66
प्रति परिणाम लागत 2.251 लागू नहीं
कुल लागत $0.555 लागू नहीं
इनपुट कीमत $1.169 / 1M लागू नहीं
आउटपुट कीमत $2.337 / 1M लागू नहीं
कुल इनपुट टोकन 90,757 98,266
आउटपुट टोकन 22,928 1,861
रीजनिंग टोकन 186,516 134,301
प्रतिक्रिया समय (औसत) 92.50s 33.05s
प्रतिक्रिया समय (अधिकतम) 416.76s 214.63s
प्रतिक्रिया समय (कुल) 2035.01s 694.04s
पैरामीटर 1.6T कुल (49B सक्रिय) 27.3B
उपलब्धता मुक्त स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 DeepSeek V4 Pro

high
लागत
$0.023
समय
257.6s
टोकन
14,870 tok

#68 Qwen3.8 27B

medium
लागत
लागू नहीं
समय
43.4s
टोकन
2,956 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

त्वरित तुलना

तुलना जोड़ी बदलें