नेविगेशन
AI BENCHY
Advertise here

Granite 4.2 8B (medium) vs Qwen3.5-9B

Granite 4.2 8B (medium) average score में आगे है: 5.2 vs 5.1. Granite 4.2 8B (medium) की benchmark लागत कम है: $0.009 vs $0.021. Qwen3.5-9B तेज है: 19.19s vs 45.97s, pass rates 34.9% vs 19.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#243
कुल आउटपुट टोकन
19,330
प्रतिक्रिया समय (औसत)
45.97s
कुल लागत
$0.009
रैंक
#250
कुल आउटपुट टोकन
37,484
प्रतिक्रिया समय (औसत)
19.19s
कुल लागत
$0.021
अनुशंसित मॉडल Qwen3.5-9B

Its score stays close to the best score here (5.1 vs 5.2), while responding about 2.4x faster than Granite 4.2 8B (medium).

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B medium रिलीज़: 2026-09-02 Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02
स्कोर 5.2 5.1
रैंक #243 #250
विश्वसनीयता 8.7 10.0
संगति 9.6 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 34.9% 19.7%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 0.117 0.490
कुल लागत $0.009 $0.021
इनपुट कीमत $0.100 / 1M $0.100 / 1M
आउटपुट कीमत $0.150 / 1M $0.150 / 1M
कुल इनपुट टोकन 52,909 144,416
आउटपुट टोकन 7,058 37,484
रीजनिंग टोकन 12,272 0
प्रतिक्रिया समय (औसत) 45.97s 19.19s
प्रतिक्रिया समय (अधिकतम) 557.96s 382.06s
प्रतिक्रिया समय (कुल) 1011.42s 422.25s
पैरामीटर 8B 9B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#243 IBM: Granite 4.2 8B

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#250 Qwen3.5-9B

none
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 5.5 10.0 33.3% 0 12.09s 8,439 2,445 3,900
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

त्वरित तुलना

तुलना जोड़ी बदलें