नेविगेशन
Advertise here

DeepSeek V3.2 vs Granite 4.2 8B (high)

average score लगभग बराबर है: 4.6 vs 4.7. DeepSeek V3.2 की benchmark लागत कम है: $0.121 vs $0.161. DeepSeek V3.2 तेज है: 22.44s vs 235.35s, pass rates 34.8% vs 37.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#320
कुल आउटपुट टोकन
57,866
प्रतिक्रिया समय (औसत)
22.44s
कुल लागत
$0.121
रैंक
#318
कुल आउटपुट टोकन
661,367
प्रतिक्रिया समय (औसत)
235.35s
कुल लागत
$0.161
अनुशंसित मॉडल DeepSeek V3.2

It has the best score here (4.6), while responding about 10.5x faster than Granite 4.2 8B (high).

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 none रिलीज़: 2025-12-01 Granite 4.2 8B Granite 4.2 8B high रिलीज़: 2026-09-02
स्कोर 4.6 4.7
रैंक #320 #318
विश्वसनीयता 10.0 8.2
संगति 8.2 6.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 34.8% 37.7%
अस्थिर टेस्ट 5 10
कुल रन 69 69
प्रति परिणाम लागत 1.943 2.751
कुल लागत $0.121 $0.161
इनपुट कीमत $0.280 / 1M $0.060 / 1M
आउटपुट कीमत $0.420 / 1M $0.250 / 1M
कुल इनपुट टोकन 342,158 282,658
आउटपुट टोकन 57,866 198,563
रीजनिंग टोकन 0 462,804
प्रतिक्रिया समय (औसत) 22.44s 235.35s
प्रतिक्रिया समय (अधिकतम) 122.50s 685.87s
प्रतिक्रिया समय (कुल) 516.03s 5413.09s
पैरामीटर 671B कुल (37B सक्रिय) 8B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#320 DeepSeek V3.2

none
लागत
$0.002
समय
7.0s
टोकन
1,046 tok

#318 IBM: Granite 4.2 8B

high
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
Granite 4.2 8B 3.8 4.3 33.3% 2 515.34s 7,047 42,438 154,749

त्वरित तुलना

तुलना जोड़ी बदलें