नेविगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 vs Laguna S 2.1 (low)

average score लगभग बराबर है: 5.0 vs 5.0. DeepSeek V3.2 की benchmark लागत कम है: $0.054 vs $0.082. DeepSeek V3.2 तेज है: 17.89s vs 85.34s, pass rates 36.4% vs 22.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#267
कुल आउटपुट टोकन
42,099
प्रतिक्रिया समय (औसत)
17.89s
कुल लागत
$0.054
रैंक
#266
कुल आउटपुट टोकन
451,708
प्रतिक्रिया समय (औसत)
85.34s
कुल लागत
$0.082
अनुशंसित मॉडल DeepSeek V3.2

It has the best score here (5.0), while costing about 1.5x less than Laguna S 2.1 (low).

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 none रिलीज़: 2025-12-01 Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.0 5.0
रैंक #267 #266
विश्वसनीयता 10.0 10.0
संगति 8.1 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 36.4% 22.7%
अस्थिर टेस्ट 5 5
कुल रन 66 66
प्रति परिणाम लागत 0.870 3.022
कुल लागत $0.054 $0.082
इनपुट कीमत $0.269 / 1M $0.090 / 1M
आउटपुट कीमत $0.400 / 1M $0.180 / 1M
कुल इनपुट टोकन 135,831 118,752
आउटपुट टोकन 42,099 67,823
रीजनिंग टोकन 0 383,885
प्रतिक्रिया समय (औसत) 17.89s 85.34s
प्रतिक्रिया समय (अधिकतम) 115.89s 814.73s
प्रतिक्रिया समय (कुल) 393.53s 1877.49s
पैरामीटर 671B कुल (37B सक्रिय) 118B कुल (8B सक्रिय)
उपलब्धता मुक्त स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#267 DeepSeek V3.2

none
लागत
$0.002
समय
7.0s
टोकन
1,046 tok

#266 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

त्वरित तुलना

तुलना जोड़ी बदलें