नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4 Pro 0423 (high) vs GPT-5.6 Luna (high)

DeepSeek V4 Pro 0423 (high) average score में आगे है: 8.1 vs 8.0. GPT-5.6 Luna (high) की benchmark लागत कम है: $0.118 vs $0.149. GPT-5.6 Luna (high) तेज है: 18.39s vs 91.29s, pass rates 65.2% vs 71.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#92
कुल आउटपुट टोकन
211,343
प्रतिक्रिया समय (औसत)
91.29s
कुल लागत
$0.149
रैंक
#96
कुल आउटपुट टोकन
139,395
प्रतिक्रिया समय (औसत)
18.39s
कुल लागत
$0.118
अनुशंसित मॉडल GPT-5.6 Luna (high)

Its score stays close to the best score here (8.0 vs 8.1), while responding about 5.0x faster than DeepSeek V4 Pro 0423 (high).

विस्तृत तुलना

मेट्रिक DeepSeek V4 Pro 0423 DeepSeek V4 Pro 0423 high रिलीज़: 2026-04-24 GPT-5.6 Luna GPT-5.6 Luna high रिलीज़: 2026-07-09
स्कोर 8.1 8.0
रैंक #92 #96
विश्वसनीयता 10.0 10.0
संगति 7.8 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 71.0%
अस्थिर टेस्ट 6 4
कुल रन 69 69
प्रति परिणाम लागत 3.717 5.882
कुल लागत $0.149 $0.118
इनपुट कीमत $0.209 / 1M $0.200 / 1M
आउटपुट कीमत $0.418 / 1M $1.200 / 1M
कैश पढ़ने की कीमत $0.018 / 1M $0.020 / 1M
कैश लिखने की कीमत लागू नहीं $0.250 / 1M
कुल इनपुट टोकन 287,061 197,896
आउटपुट टोकन 32,056 6,211
रीजनिंग टोकन 196,607 133,184
प्रतिक्रिया समय (औसत) 91.29s 18.39s
प्रतिक्रिया समय (अधिकतम) 416.76s 111.09s
प्रतिक्रिया समय (कुल) 2099.56s 422.93s
पैरामीटर 1.6T कुल (49B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 DeepSeek V4 Pro 0423

high
लागत
$0.023
समय
257.6s
टोकन
14,870 tok

#96 GPT-5.6 Luna

high
लागत
$0.033
समय
34.2s
टोकन
5,484 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 0423 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

तुलना जोड़ी बदलें