नेविगेशन
AI BENCHY
Advertise here

DeepSeek V4 Pro (high) vs GPT-5.6 Luna (high)

DeepSeek V4 Pro (high) average score में आगे है: 7.7 vs 7.6. GPT-5.6 Luna (high) की benchmark लागत कम है: $0.179 vs $0.761. GPT-5.6 Luna (high) तेज है: 16.49s vs 92.50s, pass rates 63.6% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#75
कुल आउटपुट टोकन
209,444
प्रतिक्रिया समय (औसत)
92.50s
कुल लागत
$0.761
रैंक
#78
कुल आउटपुट टोकन
135,315
प्रतिक्रिया समय (औसत)
16.49s
कुल लागत
$0.179
अनुशंसित मॉडल GPT-5.6 Luna (high)

Its score stays close to the best score here (7.6 vs 7.7), while costing about 4.3x less than DeepSeek V4 Pro (high).

विस्तृत तुलना

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro high रिलीज़: 2026-04-24 GPT-5.6 Luna GPT-5.6 Luna high रिलीज़: 2026-07-09
स्कोर 7.7 7.6
रैंक #75 #78
विश्वसनीयता 10.0 10.0
संगति 7.7 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 69.7%
अस्थिर टेस्ट 6 4
कुल रन 66 66
प्रति परिणाम लागत 2.251 6.100
कुल लागत $0.761 $0.179
इनपुट कीमत $1.600 / 1M $0.200 / 1M
आउटपुट कीमत $3.200 / 1M $1.200 / 1M
कुल इनपुट टोकन 90,757 80,927
आउटपुट टोकन 22,928 5,088
रीजनिंग टोकन 186,516 130,227
प्रतिक्रिया समय (औसत) 92.50s 16.49s
प्रतिक्रिया समय (अधिकतम) 416.76s 111.09s
प्रतिक्रिया समय (कुल) 2035.01s 362.78s
पैरामीटर 1.6T कुल (49B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 DeepSeek V4 Pro

high
लागत
$0.023
समय
257.6s
टोकन
14,870 tok

#78 GPT-5.6 Luna

high
लागत
$0.033
समय
34.2s
टोकन
5,484 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

त्वरित तुलना

तुलना जोड़ी बदलें