नेविगेशन
Advertise here

DeepSeek V4 Flash 0731 vs GPT-5.6 Luna

average score लगभग बराबर है: 5.4 vs 5.4. DeepSeek V4 Flash 0731 की benchmark लागत कम है: $0.011 vs $0.029. GPT-5.6 Luna तेज है: 1.50s vs 20.72s, pass rates 27.3% vs 36.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#254
कुल आउटपुट टोकन
25,426
प्रतिक्रिया समय (औसत)
20.72s
कुल लागत
$0.011
रैंक
#251
कुल आउटपुट टोकन
6,709
प्रतिक्रिया समय (औसत)
1.50s
कुल लागत
$0.029
अनुशंसित मॉडल GPT-5.6 Luna

It has the best score here (5.4), while responding about 13.8x faster than DeepSeek V4 Flash 0731.

विस्तृत तुलना

मेट्रिक DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 none रिलीज़: 2026-08-01 GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09
स्कोर 5.4 5.4
रैंक #254 #251
विश्वसनीयता 10.0 10.0
संगति 8.6 8.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 27.3% 36.4%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 0.509 2.357
कुल लागत $0.011 $0.029
इनपुट कीमत $0.065 / 1M $0.200 / 1M
आउटपुट कीमत $0.180 / 1M $1.200 / 1M
कुल इनपुट टोकन 94,566 101,332
आउटपुट टोकन 25,426 6,709
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 20.72s 1.50s
प्रतिक्रिया समय (अधिकतम) 387.15s 10.57s
प्रतिक्रिया समय (कुल) 455.81s 33.05s
पैरामीटर 284B कुल (13B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#254 DeepSeek V4 Flash 0731

none
लागत
$0.004
समय
198.4s
टोकन
14,316 tok

#251 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Flash 0731 4.3 10.0 0.0% 0 1.72s 7,275 505 0
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

त्वरित तुलना

तुलना जोड़ी बदलें