नेविगेशन
AI BENCHY
Advertise here

DeepSeek V4 Flash 0731 (low) vs GPT-5.2 (medium)

GPT-5.2 (medium) average score में आगे है: 8.4 vs 8.2. DeepSeek V4 Flash 0731 (low) की benchmark लागत कम है: $0.053 vs $0.951. GPT-5.2 (medium) तेज है: 22.62s vs 60.18s, pass rates 75.8% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#32
कुल आउटपुट टोकन
314,605
प्रतिक्रिया समय (औसत)
60.18s
कुल लागत
$0.053
रैंक
#27
कुल आउटपुट टोकन
54,782
प्रतिक्रिया समय (औसत)
22.62s
कुल लागत
$0.951
अनुशंसित मॉडल DeepSeek V4 Flash 0731 (low)

Its score stays close to the best score here (8.2 vs 8.4), while costing about 18.2x less than GPT-5.2 (medium).

विस्तृत तुलना

मेट्रिक DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 low रिलीज़: 2026-08-01 GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11
स्कोर 8.2 8.4
रैंक #32 #27
विश्वसनीयता 10.0 10.0
संगति 8.3 8.5
सही परीक्षण
प्रति प्रयास पास दर 75.8% 72.7%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 0.374 6.791
कुल लागत $0.053 $0.951
इनपुट कीमत $0.140 / 1M $1.750 / 1M
आउटपुट कीमत $0.280 / 1M $14.000 / 1M
कुल इनपुट टोकन 93,336 105,004
आउटपुट टोकन 40,662 9,914
रीजनिंग टोकन 273,943 44,868
प्रतिक्रिया समय (औसत) 60.18s 22.62s
प्रतिक्रिया समय (अधिकतम) 438.65s 102.93s
प्रतिक्रिया समय (कुल) 1323.92s 339.28s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 DeepSeek V4 Flash 0731

low
अमान्य SVG
लागत
$0.000
समय
78.1s
टोकन
8,090 tok

#27 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Flash 0731 7.3 5.1 77.8% 2 163.31s 5,953 782 86,028
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

त्वरित तुलना

तुलना जोड़ी बदलें