नेव्हिगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs GPT-5.6 Sol

average score जवळपास समान आहे: 7.0 vs 7.0. DeepSeek V3.2 (medium) चा benchmark खर्च कमी आहे: $0.078 vs $0.201. GPT-5.6 Sol वेगवान आहे: 2.17s vs 68.43s, pass rates 65.2% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-29

क्रमांक
#119
एकूण आउटपुट टोकन्स
128,787
प्रतिसाद वेळ (सरासरी)
68.43s
एकूण खर्च
$0.078
क्रमांक
#118
एकूण आउटपुट टोकन्स
4,357
प्रतिसाद वेळ (सरासरी)
2.17s
एकूण खर्च
$0.201
शिफारस केलेले मॉडेल GPT-5.6 Sol

It has the best score here (7.0), while responding about 31.6x faster than DeepSeek V3.2 (medium).

तपशीलवार तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 medium प्रकाशन: 2025-12-01 GPT-5.6 Sol GPT-5.6 Sol none प्रकाशन: 2026-07-09
स्कोअर 7.0 7.0
क्रमांक #119 #118
विश्वसनीयता 10.0 10.0
सुसंगतता 7.4 9.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 63.6%
अस्थिर चाचण्या 7 3
एकूण रन 66 66
प्रति निकाल खर्च 0.672 4.365
एकूण खर्च $0.078 $0.201
इनपुट किंमत $0.269 / 1M $2.000 / 1M
आउटपुट किंमत $0.400 / 1M $10.000 / 1M
एकूण इनपुट टोकन्स 101,056 78,602
आउटपुट टोकन्स 11,832 4,357
रिझनिंग टोकन्स 116,955 0
प्रतिसाद वेळ (सरासरी) 68.43s 2.17s
प्रतिसाद वेळ (कमाल) 376.10s 12.81s
प्रतिसाद वेळ (एकूण) 1505.53s 47.66s
पॅरामीटर्स 671B एकूण (37B सक्रिय) ~2T एकूण (~150B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#119 DeepSeek V3.2

medium
खर्च
$0.001
वेळ
53.6s
टोकन्स
1,932 tok

#118 GPT-5.6 Sol

none
खर्च
$0.116
वेळ
78.7s
टोकन्स
3,944 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

झटपट तुलना

तुलना जोडी बदला