नेविगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 vs GPT-4o-mini

average score लगभग बराबर है: 5.0 vs 5.0. GPT-4o-mini की benchmark लागत कम है: $0.010 vs $0.054. GPT-4o-mini तेज है: 1.92s vs 17.89s, pass rates 36.4% vs 22.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#242
कुल आउटपुट टोकन
42,099
प्रतिक्रिया समय (औसत)
17.89s
कुल लागत
$0.054
रैंक
#243
कुल आउटपुट टोकन
2,913
प्रतिक्रिया समय (औसत)
1.92s
कुल लागत
$0.010
अनुशंसित मॉडल GPT-4o-mini

It has the best score here (5.0), while costing about 5.5x less than DeepSeek V3.2.

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 none रिलीज़: 2025-12-01 GPT-4o-mini GPT-4o-mini none रिलीज़: 2024-07-18
स्कोर 5.0 5.0
रैंक #242 #243
विश्वसनीयता 10.0 10.0
संगति 8.1 9.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 36.4% 22.7%
अस्थिर टेस्ट 5 0
कुल रन 66 66
प्रति परिणाम लागत 0.870 0.195
कुल लागत $0.054 $0.010
इनपुट कीमत $0.269 / 1M $0.150 / 1M
आउटपुट कीमत $0.400 / 1M $0.600 / 1M
कुल इनपुट टोकन 135,831 53,145
आउटपुट टोकन 42,099 2,913
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 17.89s 1.92s
प्रतिक्रिया समय (अधिकतम) 115.89s 7.58s
प्रतिक्रिया समय (कुल) 393.53s 30.71s
पैरामीटर 671B कुल (37B सक्रिय) ~8B
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#242 DeepSeek V3.2

none
लागत
$0.002
समय
7.0s
टोकन
1,046 tok

#243 GPT-4o-mini

none
लागत
$0.001
समय
6.6s
टोकन
742 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

त्वरित तुलना

तुलना जोड़ी बदलें