नेविगेशन
Advertise here

DeepSeek V3.2 (medium) vs GPT-6 Luna (low)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-6 Luna (low) की benchmark लागत कम है: $0.020 vs $0.078. GPT-6 Luna (low) तेज है: 21.96s vs 68.43s, pass rates 65.2% vs 62.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#160
कुल आउटपुट टोकन
128,787
प्रतिक्रिया समय (औसत)
68.43s
कुल लागत
$0.078
रैंक
#159
कुल आउटपुट टोकन
22,605
प्रतिक्रिया समय (औसत)
21.96s
कुल लागत
$0.020
अनुशंसित मॉडल GPT-6 Luna (low)

It has the best score here (7.0), while costing about 4.0x less than DeepSeek V3.2 (medium).

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01 GPT-6 Luna GPT-6 Luna low रिलीज़: 2026-09-23
स्कोर 7.0 7.0
रैंक #160 #159
विश्वसनीयता 10.0 9.6
संगति 7.4 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 62.1%
अस्थिर टेस्ट 7 4
कुल रन 66 66
प्रति परिणाम लागत 0.672 0.176
कुल लागत $0.078 $0.020
इनपुट कीमत $0.269 / 1M $0.100 / 1M
आउटपुट कीमत $0.400 / 1M $0.500 / 1M
कुल इनपुट टोकन 101,056 80,159
आउटपुट टोकन 11,832 4,623
रीजनिंग टोकन 116,955 17,982
प्रतिक्रिया समय (औसत) 68.43s 21.96s
प्रतिक्रिया समय (अधिकतम) 376.10s 89.37s
प्रतिक्रिया समय (कुल) 1505.53s 483.19s
पैरामीटर 671B कुल (37B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#160 DeepSeek V3.2

medium
लागत
$0.001
समय
53.6s
टोकन
1,932 tok

#159 GPT-6 Luna

low
लागत
$0.002
समय
19.2s
टोकन
2,598 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

त्वरित तुलना

तुलना जोड़ी बदलें