नेविगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs GPT-5.6 Sol

average score लगभग बराबर है: 7.0 vs 7.0. DeepSeek V3.2 (medium) की benchmark लागत कम है: $0.078 vs $0.201. GPT-5.6 Sol तेज है: 2.17s vs 68.43s, pass rates 65.2% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#119
कुल आउटपुट टोकन
128,787
प्रतिक्रिया समय (औसत)
68.43s
कुल लागत
$0.078
रैंक
#118
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.17s
कुल लागत
$0.201
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (7.0), while responding about 31.6x faster than DeepSeek V3.2 (medium).

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 7.0 7.0
रैंक #119 #118
विश्वसनीयता 10.0 10.0
संगति 7.4 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.6%
अस्थिर टेस्ट 7 3
कुल रन 66 66
प्रति परिणाम लागत 0.672 4.365
कुल लागत $0.078 $0.201
इनपुट कीमत $0.269 / 1M $2.000 / 1M
आउटपुट कीमत $0.400 / 1M $10.000 / 1M
कुल इनपुट टोकन 101,056 78,602
आउटपुट टोकन 11,832 4,357
रीजनिंग टोकन 116,955 0
प्रतिक्रिया समय (औसत) 68.43s 2.17s
प्रतिक्रिया समय (अधिकतम) 376.10s 12.81s
प्रतिक्रिया समय (कुल) 1505.53s 47.66s
पैरामीटर 671B कुल (37B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#119 DeepSeek V3.2

medium
लागत
$0.001
समय
53.6s
टोकन
1,932 tok

#118 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

त्वरित तुलना

तुलना जोड़ी बदलें