नेविगेशन
AI BENCHY
Advertise here

DeepSeek V4 Flash (high) vs GPT-5.2 (medium)

GPT-5.2 (medium) average score में आगे है: 8.4 vs 7.7. DeepSeek V4 Flash (high) की benchmark लागत कम है: $0.041 vs $0.951. GPT-5.2 (medium) तेज है: 22.62s vs 49.75s, pass rates 72.7% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#52
कुल आउटपुट टोकन
168,165
प्रतिक्रिया समय (औसत)
49.75s
कुल लागत
$0.041
रैंक
#27
कुल आउटपुट टोकन
54,782
प्रतिक्रिया समय (औसत)
22.62s
कुल लागत
$0.951
अनुशंसित मॉडल DeepSeek V4 Flash (high)

Its score stays close to the best score here (7.7 vs 8.4), while costing about 23.7x less than GPT-5.2 (medium).

विस्तृत तुलना

मेट्रिक DeepSeek V4 Flash DeepSeek V4 Flash high रिलीज़: 2026-04-24 GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11
स्कोर 7.7 8.4
रैंक #52 #27
विश्वसनीयता 10.0 10.0
संगति 8.2 8.5
सही परीक्षण
प्रति प्रयास पास दर 72.7% 72.7%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 0.402 6.791
कुल लागत $0.041 $0.951
इनपुट कीमत $0.094 / 1M $1.750 / 1M
आउटपुट कीमत $0.188 / 1M $14.000 / 1M
कुल इनपुट टोकन 108,392 105,004
आउटपुट टोकन 14,478 9,914
रीजनिंग टोकन 153,687 44,868
प्रतिक्रिया समय (औसत) 49.75s 22.62s
प्रतिक्रिया समय (अधिकतम) 218.13s 102.93s
प्रतिक्रिया समय (कुल) 1094.41s 339.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#52 DeepSeek V4 Flash

high
लागत
$0.003
समय
93.1s
टोकन
7,926 tok

#27 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Flash 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

त्वरित तुलना

तुलना जोड़ी बदलें