नेविगेशन
Advertise here

DeepSeek V4.1 Flash (max) vs GPT-5.2 (medium)

GPT-5.2 (medium) average score में आगे है: 8.4 vs 8.3. DeepSeek V4.1 Flash (max) की benchmark लागत कम है: $0.537 vs $1.182. GPT-5.2 (medium) तेज है: 28.51s vs 61.35s, pass rates 68.2% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#62
कुल आउटपुट टोकन
871,126
प्रतिक्रिया समय (औसत)
61.35s
कुल लागत
$0.537
रैंक
#58
कुल आउटपुट टोकन
71,252
प्रतिक्रिया समय (औसत)
28.51s
कुल लागत
$1.182
अनुशंसित मॉडल GPT-5.2 (medium)

It has the best score here (8.4), while responding about 2.2x faster than DeepSeek V4.1 Flash (max).

विस्तृत तुलना

मेट्रिक DeepSeek V4.1 Flash DeepSeek V4.1 Flash max रिलीज़: 2026-09-10 GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11
स्कोर 8.3 8.4
रैंक #62 #58
विश्वसनीयता 9.1 10.0
संगति 9.2 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 72.7%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 3.829 8.438
कुल लागत $0.537 $1.182
इनपुट कीमत $0.150 / 1M $1.750 / 1M
आउटपुट कीमत $0.600 / 1M $14.000 / 1M
कुल इनपुट टोकन 89,024 105,013
आउटपुट टोकन 5,558 9,914
रीजनिंग टोकन 865,568 61,338
प्रतिक्रिया समय (औसत) 61.35s 28.51s
प्रतिक्रिया समय (अधिकतम) 335.08s 116.86s
प्रतिक्रिया समय (कुल) 1349.61s 456.13s
पैरामीटर 748B कुल (16B सक्रिय) ~1.2T कुल (~80B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 DeepSeek V4.1 Flash

max
लागत
$0.066
समय
211.0s
टोकन
54,712 tok

#58 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 62.50s 7,509 373 132,357
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

त्वरित तुलना

तुलना जोड़ी बदलें