नेविगेशन
AI BENCHY
Advertise here

DeepSeek V4 Flash (high) vs GPT-5.2 (medium)

GPT-5.2 (medium) average score में आगे है: 8.4 vs 7.7. DeepSeek V4 Flash (high) की benchmark लागत कम है: $0.060 vs $0.951. GPT-5.2 (medium) तेज है: 22.62s vs 49.75s, pass rates 72.7% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#62
कुल आउटपुट टोकन
168,165
प्रतिक्रिया समय (औसत)
49.75s
कुल लागत
$0.060
रैंक
#33
कुल आउटपुट टोकन
54,782
प्रतिक्रिया समय (औसत)
22.62s
कुल लागत
$0.951
अनुशंसित मॉडल DeepSeek V4 Flash (high)

Its score stays close to the best score here (7.7 vs 8.4), while costing about 15.9x less than GPT-5.2 (medium).

विस्तृत तुलना

मेट्रिक DeepSeek V4 Flash DeepSeek V4 Flash high रिलीज़: 2026-04-24 GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11
स्कोर 7.7 8.4
रैंक #62 #33
विश्वसनीयता 10.0 10.0
संगति 8.2 8.5
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 72.7% 72.7%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 0.402 6.791
कुल लागत $0.060 $0.951
इनपुट कीमत $0.140 / 1M $1.750 / 1M
आउटपुट कीमत $0.280 / 1M $14.000 / 1M
कुल इनपुट टोकन 108,392 105,004
आउटपुट टोकन 14,478 9,914
रीजनिंग टोकन 153,687 44,868
प्रतिक्रिया समय (औसत) 49.75s 22.62s
प्रतिक्रिया समय (अधिकतम) 218.13s 102.93s
प्रतिक्रिया समय (कुल) 1094.41s 339.28s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 DeepSeek V4 Flash

high
लागत
$0.003
समय
93.1s
टोकन
7,926 tok

#33 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Flash 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

त्वरित तुलना

तुलना जोड़ी बदलें