नेविगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs GPT-5.5

average score लगभग बराबर है: 7.0 vs 7.0. DeepSeek V3.2 (medium) की benchmark लागत कम है: $0.078 vs $0.544. GPT-5.5 तेज है: 2.35s vs 68.43s, pass rates 65.2% vs 59.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#116
कुल आउटपुट टोकन
128,787
प्रतिक्रिया समय (औसत)
68.43s
कुल लागत
$0.078
रैंक
#118
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
अनुशंसित मॉडल DeepSeek V3.2 (medium)

It has the best score here (7.0), while costing about 7.1x less than GPT-5.5.

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 7.0 7.0
रैंक #116 #118
विश्वसनीयता 10.0 10.0
संगति 7.4 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 59.1%
अस्थिर टेस्ट 7 2
कुल रन 66 66
प्रति परिणाम लागत 0.672 4.533
कुल लागत $0.078 $0.544
इनपुट कीमत $0.269 / 1M $5.000 / 1M
आउटपुट कीमत $0.400 / 1M $30.000 / 1M
कुल इनपुट टोकन 101,056 79,294
आउटपुट टोकन 11,832 4,915
रीजनिंग टोकन 116,955 0
प्रतिक्रिया समय (औसत) 68.43s 2.35s
प्रतिक्रिया समय (अधिकतम) 376.10s 12.24s
प्रतिक्रिया समय (कुल) 1505.53s 51.78s
पैरामीटर 671B कुल (37B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#116 DeepSeek V3.2

medium
लागत
$0.001
समय
53.6s
टोकन
1,932 tok

#118 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

त्वरित तुलना

तुलना जोड़ी बदलें